🚨 NOVA NOTÍCIA EM DESTAQUE! 🚨
Não deixe essa passar: clique e saiba tudo!
Apoie esse projeto de divulgacao de noticias! Clique aqui
A Microsoft afirma que um bug em seu sistema automatizado de solicitação de manutenção de rede causou a grande interrupção de quinta-feira ao remover erroneamente rotas IP de mais dispositivos do que o pretendido, interrompendo os serviços Azure e Microsoft 365.
A interrupção começou às 10h44 ET de quinta-feira, 23 de julho, e afetou principalmente os clientes que acessavam os serviços do Microsoft 365 por meio da infraestrutura de rede conectada à região Azure Oeste dos EUA da Microsoft.
Às 11h11 ET, o Downdetector registrou 2.403 relatórios de interrupções, bem acima de sua linha de base normal de 29. O SharePoint foi responsável por 78% das reclamações, seguido pelo Excel com 11% e o Microsoft 365 Admin Center com 6%.
A Microsoft rastreou a interrupção do Microsoft 365 sob o ID de incidente MO1437424 e confirmou que vários serviços do Microsoft 365 foram afetados:
Microsoft OneDrive – O acesso ao OneDrive era intermitente.
SharePoint Online - Os usuários receberam erros "Algo deu errado".
Microsoft Teams – A funcionalidade de bate-papo foi degradada, incluindo imagens que não carregam.
Centro de Administração do Microsoft 365 – O Centro de Administração foi carregado lentamente ou não foi carregado.
Power Automate - Os fluxos automatizados não foram carregados.
Copilot Chat – Os usuários experimentaram atrasos ou falhas intermitentes ao executar ações e consultas.
Microsoft Loop - Os usuários não conseguiram abrir ou carregar páginas do Loop.
Outros serviços afetados incluíram Fabric e Power BI, Power Apps, Copilot Studio, Windows 365 e Microsoft Defender.
Alguns clientes do Defender enfrentaram atrasos no recebimento de respostas dos especialistas do Microsoft Defender, enquanto investigações, fluxos de trabalho e ações de correção acionadas por meio do Threat Explorer e do Advanced Hunting poderiam falhar.
A Microsoft inicialmente tentou mitigar a interrupção redirecionando o tráfego através de caminhos de rede alternativos, o que ajudou os clientes, mas muitos serviços continuaram a ser afetados.
Antes de determinar o que causou a interrupção, a Microsoft alertou os clientes que talvez precisassem revisar seus planos de continuidade de negócios e recuperação de desastres e tomar medidas apropriadas para seus ambientes.
Posteriormente, a empresa identificou uma mudança recente na rede como a causa e começou a revertê-la.
A Microsoft concluiu a reversão às 14h26 horário do leste dos EUA e confirmou por meio de telemetria de serviço e relatórios de clientes que o incidente do Microsoft 365 foi resolvido.
Bug de manutenção causou interrupção
Em uma revisão preliminar pós-incidente para o incidente do Azure, a Microsoft disse que a interrupção foi desencadeada durante a manutenção de rotina do dispositivo na região oeste do Azure nos EUA, onde caminhos de rede específicos estavam sendo isolados.
A Microsoft diz que seu processo de manutenção converte esses tipos de solicitações em instruções legíveis pelo sistema e verifica se pelo menos um dos dois caminhos redundantes permanece íntegro antes do início do trabalho.
No entanto, um bug no sistema de conversão de solicitações marcou incorretamente dispositivos de rede adicionais como parte do evento de manutenção.
Como resultado, as rotas IP foram removidas de mais dispositivos do que o pretendido entre o datacenter da Microsoft no oeste dos EUA e sua rede de longa distância.
As rotas removidas interromperam o tráfego de rede que entrava ou saía da região oeste dos EUA. No entanto, a Microsoft disse que o tráfego restante inteiramente na região não foi afetado.
O incidente do Azure causou falhas de conectividade, aumento de latência e problemas de acesso a vários serviços de nuvem, incluindo Azure App Service, Application Gateway, Azure AD B2C, Azure AI Search, Azure API Management, Azure Cosmos DB, Azure Databricks, Azure Firewall, Azure Kubernetes Service, Azure Monitor, Azure Virtual Desktop, ExpressRoute, Log Analytics, Microsoft Graph, Microsoft Sentinel, Power BI Embedded, Virtual WAN e VPN Gateway.
A Microsoft disse que seus engenheiros começaram a investigar os problemas imediatamente após o início da interrupção, às 10h44, horário do leste dos EUA.
O problema inicialmente se apresentou como uma rotatividade em grande escala na WAN da Microsoft. Posteriormente, os engenheiros rastrearam as remoções de rota até um datacenter na região oeste dos EUA e as vincularam à recente atividade de manutenção.
A Microsoft iniciou uma reversão da mudança de manutenção às 13h45 ET, que foi concluída às 14h26 ET.
A reversão restaurou a infraestrutura de rede afetada e permitiu a recuperação dos serviços do Microsoft 365. Alguns serviços do Azure continuaram a se recuperar após a implementação da correção, com a Microsoft relatando que todos os serviços afetados foram totalmente recuperados às 15h41 horário do leste dos EUA.
A Microsoft está agora conduzindo uma revisão interna completa focada nas verificações de segurança e nos processos automatizados usados para executar solicitações de manutenção.
“Estaremos realizando uma análise completa com foco em verificações de segurança, processo automatizado de alteração de solicitações de manutenção e muito mais à medida que avançamos em nossa retrospectiva interna pós-mitigação”, explicou a Microsoft.
A empresa disse que publicará uma revisão pós-incidente final após concluir sua investigação, o que geralmente ocorre em 14 dias.
Teste todas as camadas antes que os invasores o façam
S
A interrupção começou às 10h44 ET de quinta-feira, 23 de julho, e afetou principalmente os clientes que acessavam os serviços do Microsoft 365 por meio da infraestrutura de rede conectada à região Azure Oeste dos EUA da Microsoft.
Às 11h11 ET, o Downdetector registrou 2.403 relatórios de interrupções, bem acima de sua linha de base normal de 29. O SharePoint foi responsável por 78% das reclamações, seguido pelo Excel com 11% e o Microsoft 365 Admin Center com 6%.
A Microsoft rastreou a interrupção do Microsoft 365 sob o ID de incidente MO1437424 e confirmou que vários serviços do Microsoft 365 foram afetados:
Microsoft OneDrive – O acesso ao OneDrive era intermitente.
SharePoint Online - Os usuários receberam erros "Algo deu errado".
Microsoft Teams – A funcionalidade de bate-papo foi degradada, incluindo imagens que não carregam.
Centro de Administração do Microsoft 365 – O Centro de Administração foi carregado lentamente ou não foi carregado.
Power Automate - Os fluxos automatizados não foram carregados.
Copilot Chat – Os usuários experimentaram atrasos ou falhas intermitentes ao executar ações e consultas.
Microsoft Loop - Os usuários não conseguiram abrir ou carregar páginas do Loop.
Outros serviços afetados incluíram Fabric e Power BI, Power Apps, Copilot Studio, Windows 365 e Microsoft Defender.
Alguns clientes do Defender enfrentaram atrasos no recebimento de respostas dos especialistas do Microsoft Defender, enquanto investigações, fluxos de trabalho e ações de correção acionadas por meio do Threat Explorer e do Advanced Hunting poderiam falhar.
A Microsoft inicialmente tentou mitigar a interrupção redirecionando o tráfego através de caminhos de rede alternativos, o que ajudou os clientes, mas muitos serviços continuaram a ser afetados.
Antes de determinar o que causou a interrupção, a Microsoft alertou os clientes que talvez precisassem revisar seus planos de continuidade de negócios e recuperação de desastres e tomar medidas apropriadas para seus ambientes.
Posteriormente, a empresa identificou uma mudança recente na rede como a causa e começou a revertê-la.
A Microsoft concluiu a reversão às 14h26 horário do leste dos EUA e confirmou por meio de telemetria de serviço e relatórios de clientes que o incidente do Microsoft 365 foi resolvido.
Bug de manutenção causou interrupção
Em uma revisão preliminar pós-incidente para o incidente do Azure, a Microsoft disse que a interrupção foi desencadeada durante a manutenção de rotina do dispositivo na região oeste do Azure nos EUA, onde caminhos de rede específicos estavam sendo isolados.
A Microsoft diz que seu processo de manutenção converte esses tipos de solicitações em instruções legíveis pelo sistema e verifica se pelo menos um dos dois caminhos redundantes permanece íntegro antes do início do trabalho.
No entanto, um bug no sistema de conversão de solicitações marcou incorretamente dispositivos de rede adicionais como parte do evento de manutenção.
Como resultado, as rotas IP foram removidas de mais dispositivos do que o pretendido entre o datacenter da Microsoft no oeste dos EUA e sua rede de longa distância.
As rotas removidas interromperam o tráfego de rede que entrava ou saía da região oeste dos EUA. No entanto, a Microsoft disse que o tráfego restante inteiramente na região não foi afetado.
O incidente do Azure causou falhas de conectividade, aumento de latência e problemas de acesso a vários serviços de nuvem, incluindo Azure App Service, Application Gateway, Azure AD B2C, Azure AI Search, Azure API Management, Azure Cosmos DB, Azure Databricks, Azure Firewall, Azure Kubernetes Service, Azure Monitor, Azure Virtual Desktop, ExpressRoute, Log Analytics, Microsoft Graph, Microsoft Sentinel, Power BI Embedded, Virtual WAN e VPN Gateway.
A Microsoft disse que seus engenheiros começaram a investigar os problemas imediatamente após o início da interrupção, às 10h44, horário do leste dos EUA.
O problema inicialmente se apresentou como uma rotatividade em grande escala na WAN da Microsoft. Posteriormente, os engenheiros rastrearam as remoções de rota até um datacenter na região oeste dos EUA e as vincularam à recente atividade de manutenção.
A Microsoft iniciou uma reversão da mudança de manutenção às 13h45 ET, que foi concluída às 14h26 ET.
A reversão restaurou a infraestrutura de rede afetada e permitiu a recuperação dos serviços do Microsoft 365. Alguns serviços do Azure continuaram a se recuperar após a implementação da correção, com a Microsoft relatando que todos os serviços afetados foram totalmente recuperados às 15h41 horário do leste dos EUA.
A Microsoft está agora conduzindo uma revisão interna completa focada nas verificações de segurança e nos processos automatizados usados para executar solicitações de manutenção.
“Estaremos realizando uma análise completa com foco em verificações de segurança, processo automatizado de alteração de solicitações de manutenção e muito mais à medida que avançamos em nossa retrospectiva interna pós-mitigação”, explicou a Microsoft.
A empresa disse que publicará uma revisão pós-incidente final após concluir sua investigação, o que geralmente ocorre em 14 dias.
Teste todas as camadas antes que os invasores o façam
S
#samirnews #samir #news #boletimtec #a #microsoft #atribui #a #interrupção #massiva #do #microsoft #365 #a #um #bug #de #manutenção
💡 Compartilhe e ajude nosso projeto a crescer!
Postar um comentário