Home Technologie et scienceKubernetes 1.35 permet une mise à l’échelle des ressources sans temps d’arrêt pour les charges de travail cloud de production

Kubernetes 1.35 permet une mise à l’échelle des ressources sans temps d’arrêt pour les charges de travail cloud de production

by Thomas Caron

Publié le 2025-12-17 16:04:00. Kubernetes, la plateforme open source d’orchestration de conteneurs, facilite désormais l’ajustement des ressources allouées aux applications sans interruption de service, une avancée particulièrement bénéfique pour les charges de travail exigeantes en calcul comme l’intelligence artificielle et l’informatique de pointe.

  • Kubernetes permet désormais de modifier les limites de ressources des pods en cours d’exécution, évitant les redémarrages et les interruptions.
  • Cette nouvelle fonctionnalité est particulièrement adaptée aux applications d’entraînement en intelligence artificielle et aux déploiements d’informatique de pointe.
  • Une fonctionnalité de planification de gangs (Gang Scheduling) est également introduite pour optimiser le lancement simultané de plusieurs pods.

Jusqu’à récemment, toute modification des demandes de ressources ou des limites imposées à un pod nécessitait sa destruction et la création d’une nouvelle instance avec les spécifications actualisées. Cette opération entraînait inévitablement une mise hors ligne temporaire de l’application, une interruption des connexions réseau et la planification de fenêtres de maintenance pour les opérations courantes.

La nouvelle implémentation contourne ces contraintes en modifiant directement les paramètres des groupes de contrôle (cgroups) sur les conteneurs en cours d’exécution. Ainsi, lorsque les spécifications des ressources évoluent, Kubernetes met à jour le groupe de contrôle existant au lieu de recréer le pod. Les applications continuent de fonctionner sans la moindre interruption.

Cette amélioration est particulièrement pertinente pour les charges de travail d’entraînement à l’intelligence artificielle, qui nécessitent souvent des ajustements dynamiques des ressources. Les tâches d’apprentissage peuvent désormais évoluer verticalement sans redémarrage, optimisant ainsi l’utilisation des ressources et réduisant les temps d’exécution. Les environnements Edge, où la flexibilité des ressources est cruciale, bénéficient également de cette nouvelle capacité, sans la complexité liée à la recréation des pods.

« Pour l’IA, c’est un travail d’entraînement très important qui peut être mis à l’échelle et ajusté verticalement, et pour l’informatique de pointe, c’est vraiment énorme là où il y a une complexité accrue et l’ajustement de ces charges de travail. »

Hagen

L’utilisation de cette fonctionnalité requiert la présence de groupes de contrôle v2 sur les nœuds Linux sous-jacents. Kubernetes 1.35 marquera la fin du support des cgroups v1. Bien que la plupart des distributions Linux d’entreprise actuelles intègrent déjà cgroups v2, les déploiements plus anciens pourraient nécessiter une mise à niveau du système d’exploitation avant de pouvoir profiter des ajustements de ressources sur place.

Gang Scheduling prend en charge les charges de travail d’IA distribuées

Parmi les nouvelles fonctionnalités présentées, on retrouve également le “Gang Scheduling”, une fonctionnalité destinée à faciliter le déploiement d’applications distribuées qui nécessitent le démarrage simultané de plusieurs pods. Cette fonctionnalité, suivie sous le nom de KEP-4671, optimise ainsi la coordination et la performance de ces applications complexes.

You may also like

Leave a Comment