211service.com
L'errore di battitura da $ 150 milioni di Amazon è un parafulmine per un grosso problema con il cloud
Se hai intenzione di mettere tutti i tuoi dati nel cloud, vuoi che sia un cloud ben costruito. Questa settimana, Amazon, il più grande fornitore mondiale di tali infrastrutture, ha dimostrato che le capacità di costruzione sono ancora carenti.
Martedì, gran parte di Internet ha semplicemente smesso di funzionare. Slack non permetterebbe alle persone di comunicare con i colleghi, Trello non ti permetterebbe di gestire un progetto e, purtroppo, il Revisione della tecnologia del MIT il sito Web non ti consente di leggere la tecnologia emergente. Ci sono state anche lamentele sul fatto che l'hardware della casa intelligente non funzionasse correttamente.
La ragione: Il sistema di archiviazione cloud S3 di Amazon non è riuscito . Amazon è il più grande fornitore di cloud computing al mondo, quindi anche molti servizi che si basano su di esso non sono stati in grado di funzionare correttamente. E questo non è stato solo un inconveniente: il problema ha richiesto almeno quattro ore per essere risolto.
È difficile quantificare con precisione il vero costo di un'interruzione del genere. Ma, secondo il giornale di Wall Street , la società di analisi Cyence ha stimato che sia costato alle aziende dell'S&P 500 almeno $ 150 milioni. E la società di monitoraggio del traffico Apica afferma che 54 dei primi 100 rivenditori online hanno registrato un calo delle prestazioni del sito di almeno il 20%. Quindi non c'è modo di aggirare il fatto che fosse costoso.
Questo rende il motivo per cui è successo ancora più imbarazzante. In un dichiarazione che descrive cosa è andato storto , Amazon ha ammesso che la causa principale dell'interruzione era un comando errato eseguito da un membro del personale presso la sua struttura della Virginia del Nord durante la manutenzione ordinaria. Purtroppo, ha provocato una catastrofica cascata di eventi.
Il lavoratore avrebbe dovuto portare offline un numero limitato di server, ma ha commesso un errore e ha rimosso più server del previsto, inclusi due utilizzati per alimentare i processi fondamentali utilizzati nell'intero sistema. L'errore ha sostanzialmente cancellato la capacità della struttura di elaborare le richieste degli utenti.
Amazon gestisce più 'aree' cloud sparse in tutto il mondo e i clienti dei suoi servizi sono in grado di archiviare file ed eseguire codice su più di una di esse. Ma è più costoso e, come annota il Registro , anche le aziende che gestiscono i propri servizi in diverse aree geografiche hanno riscontrato il guasto dei propri sistemi, probabilmente a causa di problemi di capacità.
Appena quattro giorni prima dell'interruzione, abbiamo descritto i rischi intrinseci dei servizi Web centralizzati e ipotizzato l'impatto che si sarebbe sentito se il servizio cloud di Amazon non avesse funzionato. All'epoca, abbiamo avvertito che la posta in gioco è alta, sostenendo che sicurezza, affidabilità e competenza sono vitali, e forse sottorappresentate, per le aziende che forniscono servizi Web centralizzati.
Amazon sembra essere d'accordo. Sono già state messe in atto misure di sicurezza in modo che incidenti come quello causato dal membro dello staff dal pugno di ferro non possano chiudere così tanti server altrettanto rapidamente in futuro.
Questo è un inizio. Ma è chiaro a questo punto che i servizi cloud necessitano di polizze assicurative aggiuntive se vogliono essere robusti. Amazon, ad esempio, non avrebbe dovuto nemmeno essere in grado di finire in una situazione in cui l'intera struttura della Virginia del Nord avrebbe potuto guastarsi in una volta, invece, dovrebbe essere suddivisa in sottosistemi separati che funzionano in modo indipendente.
Anche in questo caso, i servizi Web centralizzati potrebbero essere ancora vulnerabili. Se un hacker lancia un attacco enorme a un singolo provider, ad esempio utilizzando una botnet, potrebbe comunque forzare nuovamente la connessione offline di gran parte del Web. Ma almeno non sarebbe il risultato di un errore di battitura.
(Per saperne di più: giornale di Wall Street , T lui si registra , AP , Servizi Web Amazon , I servizi Web centralizzati sono meravigliosi, finché non vanno male , 10 tecnologie rivoluzionarie: le botnet delle cose )