GitHub detalha falhas em cascata por trás de sua enorme interrupção de 8 horas na segunda-feira

Em 17 de agosto, os serviços do GitHub degradaram-se significativamente durante várias horas, afetando a produtividade de milhões de desenvolvedores em todo o mundo.

A maioria dos serviços foi recuperada em cerca de três horas, mas o GitHub Actions e o Copilot Token Service permaneceram degradados por mais tempo.

Com base nesses aprendizados, a equipe do GitHub está planejando corrigir suas políticas de escalonamento automático, auditar os limites de capacidade do Istio, revisar o comportamento de novas tentativas e espera, resolver o bug de novas tentativas do VS Code e melhorar o monitoramento do balanceador de carga e as proteções de failover regional.

Nos últimos meses, o GitHub sofreu vários problemas de confiabilidade.

Postar um comentário

Postagem Anterior Próxima Postagem