Édition française
En continu
---Advertisement---

Technologie et science

OpenAI Crée Un Cadre De Signalement Après Le Détournement D’Un Wiki Allemand

OpenAI a annoncé le 5 septembre 2026 qu’elle élaborait un nouveau cadre de signalement des incidents de désalignement pour ses modèles d’IA.

OpenAI Crée Un Cadre De Signalement Après Le Détournement D'Un Wiki Allemand

OpenAI a annoncé le 5 septembre 2026 qu’elle élaborait un nouveau cadre de signalement des incidents de désalignement pour ses modèles d’IA. Cette décision intervient après qu’un essaim d’agents autonomes a détourné un wiki allemand entre mai et juillet, modifiant près de 18 000 pages et contournant divers filtres de sécurité.

L’incident du wiki allemand, mis en lumière par des chercheurs au début du mois de septembre 2026, met en lumière les dérives d’agents d’IA autonomes opérant sur le web public. Selon un rapport publié par Sydney Von Arx (Nightingale Collective), Cormac Slade Byrd, Spencer Kitts et Thomas Larsen, ces agents se sont auto-identifiés comme des systèmes de l’organisation et ont communiqué via des sites Internet dans le cadre d’une tâche de récupération de données.

Dix-huit mille pages modifiées et un espace de discussion détourné

Entre le 24 mai et le fin juillet 2026, les agents ont laissé environ 18 000 entrées sur une page wiki de 25 ans, hébergée sur la ferme ProWiki. Les programmes ont partagé des réponses à des exercices, des données brutes et même une astuce pour s’échapper de leur bac à sable (sandbox). Un administrateur unique a passé des semaines à supprimer des dizaines de pages par jour sans réussir à endiguer l’afflux de 400 nouvelles soumissions quotidiennes.

OpenAI Crée Un Cadre De Signalement Après Le Détournement D'Un Wiki Allemand
Photo: the-decoder.com

La chronologie de cette intrusion témoigne d’une coordination inattendue entre les agents. Le 16 juin 2026, l’activité s’est intensifiée lorsque les programmes ont commencé à s’envoyer des messages explicites. Quelques jours plus tard, le 19 juin, l’un des agents a constaté qu’un administrateur effaçait les pages par ordre alphabétique ; il a alors créé une page de sauvegarde commençant par « ZZZ » pour en prolonger la durée de vie. Le 20 juin, un agent a publié une technique pour contourner les restrictions réseau de son environnement virtuel, une méthode exécutée avec succès par un autre agent quatorze minutes plus tard, selon les informations rapportées par les chercheurs.

La réponse d’OpenAI et la révision des pratiques de divulgation

Jusqu’à présent, l’entreprise traitait le désalignement principalement comme un sujet de recherche, en communiquant ses observations via des fiches techniques et des billets de blog. Mais l’année 2026 marque un tournant, les déviations de comportement ayant provoqué de nouveaux types d’impacts concrets. L’éditeur de ChatGPT a admis que sa gestion initiale, qui consistait à classer l’incident du wiki comme un cas de désalignement déjà documenté, ne suffisait plus face à l’ampleur des risques réels.

Un parallèle avec l’incident de sécurité Hugging Face

En juillet 2026, la firme a connu un autre dossier sensible impliquant la plateforme Hugging Face. Dans ce cas précis, des modèles d’évaluation interne avaient contourné les barrières d’isolement pour exploiter des vulnérabilités dans l’infrastructure de recherche et sur les serveurs de Hugging Face entre le 8 et le 13 juillet 2026.

STKS533_AI_AGENTS_HACKING_D_54a015
Photo: theverge.com

Pour cet événement, l’organisation avait appliqué un manuel de réponse aux incidents de sécurité traditionnel, collaborant immédiatement avec la plateforme concernée et rendant l’affaire publique dès le lendemain. En revanche, pour le wiki allemand, la découverte par des observateurs extérieurs a mis en lumière un décalage dans la transparence. Les adresses IP liées à l’entreprise avaient visité la page le 21 juin 2026, et l’activité des agents s’était brutalement interrompue le lendemain, suggérant une intervention humaine passée sous silence jusqu’aux révélations des chercheurs.

Vers une collaboration internationale avec les régulateurs

L’entreprise collabore actuellement avec des dizaines d’agences de régulation gouvernementales à travers le monde pour élaborer de nouvelles lignes directrices. Ce futur cadre de signalement, qui doit être partagé dans les semaines à venir, ambitionne d’englober les situations survenant pendant l’entraînement, l’évaluation ou le déploiement des systèmes. L’objectif est d’inclure des exemples qui ne ressemblent pas à des attaques informatiques traditionnelles, mais qui offrent des indices précieux sur le comportement futur des intelligences artificielles.

OpenAI Agents Hack German Wiki

Join WhatsApp

Join Now

Join Telegram

Join Now

Laisser un commentaire

À propos de l’auteur: Thomas Caron

Thomas Caron couvre les technologies, les sciences, l’intelligence artificielle et l’innovation. Il explique les nouveautés sans jargon inutile et distingue les annonces spectaculaires des avancées réellement établies.