A Amazon Web Services (AWS) confirmou que um defeito em seu banco de dados DynamoDB provocou a queda de diversos serviços na segunda-feira, 20 de outubro. A instabilidade afetou clientes em várias partes do mundo e só foi totalmente solucionada na terça-feira (21).
Como o problema começou
De acordo com comunicado da companhia, a falha teve origem na região US-East-1, na Virgínia do Norte, onde estão localizados os principais datacenters da AWS. Um bug latente no sistema automatizado de gerenciamento de DNS do DynamoDB aumentou as taxas de erro de conexão, interrompendo o acesso de usuários e exigindo intervenção manual para correção.
Impacto global
No pico do incidente, mais de 6,5 milhões de usuários relataram dificuldades de acesso. Plataformas como Alexa, Zoom, Duolingo, Snapchat, Fortnite, Mercado Livre e Prime Video registraram instabilidades. Colchões inteligentes da Eight Sleep também apresentaram comportamento inesperado, como travamento em posição inclinada, variação de temperatura e alarmes acionados sem comando.
Esforços de recuperação
Durante toda a segunda-feira, a AWS publicou atualizações frequentes sobre o andamento dos reparos. Alguns serviços foram restabelecidos ainda na noite do dia 20, mas a normalização completa ocorreu somente no dia seguinte.
Imagem: Internet
Segundo a empresa, o DynamoDB conta com mecanismos automáticos para distribuição de tráfego e expansão de capacidade. Contudo, o bug impediu que essas rotinas fossem executadas, exigindo ação manual dos engenheiros.
Com informações de WizyThec

