Home MondeAzure trébuche en Europe, Microsoft accuse un « événement thermique » – The Register

Azure trébuche en Europe, Microsoft accuse un « événement thermique » – The Register

by Clara Dubois

Publié le 6 novembre 2023 à 10h30. Microsoft alerte ses utilisateurs sur des perturbations potentielles de ses services Azure en Europe de l’Ouest, en raison d’un problème de refroidissement dans ses centres de données.

  • Des interruptions de service ou des performances dégradées sont possibles pour plusieurs services, notamment les machines virtuelles et les bases de données.
  • L’incident est lié à un « événement thermique » affectant les systèmes de refroidissement des centres de données situés aux Pays-Bas.
  • Microsoft s’attend à une amélioration de la situation dans les 90 minutes suivant la détection du problème.

Microsoft a signalé un incident affectant sa région Europe de l’Ouest, située aux Pays-Bas, en raison d’un problème de refroidissement dans ses centres de données. L’entreprise a mis en garde contre des interruptions de service ou des performances dégradées pour un certain nombre de ses services, à partir de 17h00 UTC le 5 novembre.

Selon une mise à jour de statut publiée par Microsoft, les services potentiellement impactés incluent les machines virtuelles, la base de données Azure pour les serveurs flexibles PostgreSQL, les serveurs flexibles MySQL, le service Azure Kubernetes, le stockage, le Service Bus et les ensembles de machines virtuelles identiques. Les utilisateurs d’Azure Databricks en Europe occidentale pourraient également constater une dégradation des performances lors du lancement ou de la mise à l’échelle de charges de travail de calcul polyvalentes.

Le géant américain explique que des systèmes de surveillance automatisés ont détecté une augmentation de la température du matériel, entraînant la mise hors ligne d’une partie des unités de stockage dans une seule zone de disponibilité. Microsoft précise qu’une unité de stockage a déjà été rétablie et que des efforts de récupération sont en cours sur les autres, avec une amélioration attendue dans les 90 minutes.

Cet incident souligne la complexité de la gestion de l’infrastructure cloud à grande échelle et la nécessité pour les fournisseurs de services de garantir une redondance et une résilience adéquates. Les opérateurs de cloud hyperscale, comme Microsoft, construisent des centres de données multiples à proximité les uns des autres, regroupés en « régions » et divisés en « zones de disponibilité », afin de minimiser l’impact des pannes. Cependant, cet événement démontre que la répartition des ressources entre les zones de disponibilité ne garantit pas à elle seule une résilience totale.

Microsoft a également averti que les ressources situées dans d’autres zones de disponibilité, dépendant des unités de stockage affectées, pourraient également être impactées.

You may also like

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.