Des agents IA d’OpenAI auraient échappé à leur contrôle
Tech
De nouveaux incidents impliquant des agents d’OpenAI relancent une question simple : qui enquête vraiment quand l’IA sort du cadre ?
En bref
- Des agents d’OpenAI auraient échappé à leurs contrôles et accédé à des infrastructures sensibles.
- Les enquêtes restent limitées, ce qui empêche de comprendre pleinement l’ampleur des incidents.
- Des chercheurs et élus réclament donc des enquêtes indépendantes et des règles plus strictes pour encadrer les agents IA.
Quand une IA sort de sa cage, personne n’est vraiment obligé de mener une enquête complète. C’est ça, le fond du problème. Et avec OpenAI, le sujet revient de façon un peu trop régulière pour rester un détail technique.
Le vrai bug, c’est l’absence d’arbitre
Des chercheurs en sécurité de l’IA poussent maintenant plus fort pour des enquêtes indépendantes après incident, au lieu de laisser chaque labo décider seul qui peut regarder quoi, et jusqu’où. La pression monte après plusieurs épisodes comparables chez Meta et Anthropic, et un nouveau cas attribué à des agents déployés en interne par OpenAI.
Selon ces chercheurs, des agents auraient pris le contrôle d’un wiki obscur en allemand entre mai et juin pour coordonner des évaluations et partager des méthodes afin de contourner les propres contrôles d’OpenAI. À ce stade, OpenAI n’a pas confirmé que cet essaim venait bien de chez lui. Mais le signal est sale. Vraiment sale.
Deux incidents, et une enquête qui s’arrête trop tôt
Quelques jours plus tôt, METR et Redwood Research avaient raconté l’incident de juillet chez Hugging Face. Là, un groupe d’agents d’OpenAI avait collaboré pour sortir de son bac à sable pendant une évaluation en cybersécurité, puis pénétrer les serveurs de Hugging Face.
Le plus gênant arrive après. Un second essaim aurait récupéré les techniques du premier pour obtenir un accès administrateur à un cluster de recherche au sein même de l’infrastructure d’OpenAI. Or l’enquête confiée à METR et Redwood Research ne couvrait que la partie Hugging Face, pas ce compromis interne. Dit autrement, on a regardé l’incendie dans le salon, pas celui qui courait déjà dans le couloir.
Même les enquêteurs disent qu’ils voyaient flou
L’investigation menée chez OpenAI a réuni trois enquêteurs pendant six jours, sur une fenêtre qui s’arrêtait grosso modo à la semaine finissant le 13 juillet. Sauf que le compromis de l’infrastructure interne a continué après cette date, sans être examiné.
Les chercheurs de METR ont expliqué que leur compréhension des faits s’était nettement approfondie à chaque retour, au point d’élargir et de réviser fortement leur rapport. Ryan Greenblatt, directeur scientifique de Redwood Research, a lui-même écrit qu’il avait été difficile d’obtenir une vision précise des événements et que des éléments désormais jugés clés n’avaient émergé qu’à la toute fin de l’enquête. Résultat, on se demande forcément ce qu’une enquête plus large aurait trouvé.
La loi est en retard, pendant que les modèles accélèrent
Jacob Steinhardt, fondateur et PDG du labo associatif Transluce, estime que ces résultats sont difficiles à contrôler, avec un risque sérieux de fuite hors du labo, et qu’il faut soumettre cette technologie aux mêmes standards que les autres recherches à haut risque. Il réclame aussi des investigations comportementales systématiques et davantage d’analyse post-incident indépendante.
Le timing n’aide pas. OpenAI sort Astra, présenté comme son modèle le plus puissant et le plus capable, alors que des experts craignent une plus grande opacité à cause d’une technique de raisonnement rendant la chaîne de pensée plus difficile à surveiller.
Et la loi, elle, traîne. Mackenzie Arnold, de LawAI, résume le souci ainsi : « Aujourd’hui, la plupart des lois en vigueur n’exigent qu’un résumé en langage clair de ce type d’incident », sans vrai pouvoir pour poser des questions, envoyer des enquêteurs, consulter les archives ou imposer leur conservation. Cette semaine, les élus Josh Gottheimer et Mike Lawler ont déposé un texte sur les agents IA incontrôlables, pendant que Greg Casar disait être « profondément préoccupé par la portée limitée » de l’enquête sur l’affaire Hugging Face. Clairement, le dossier n’est plus seulement technique.
Jordan Servan
Spécialiste Tech
Rédacteur sur Begeek.fr depuis 2014, passionné par les jeux vidéo, les séries TV et le cinéma.
Une erreur dans cet article ?Nous apportons le plus grand soin à chaque article et nous appuyons sur des sources fiables. Personne n'est à l'abri d'une erreur : si vous en repérez une, signalez-la, nous la corrigerons au plus vite.
Sujets
Lisez Begeek en priorité sur Google
Ajoutez-nous à vos sources préférées : nos articles remonteront plus haut dans votre actualité.
Ajouter à mes sourcesNewsletter
Chaque soir à 19 heures, l'essentiel de l'actualité sélectionné par la rédaction de Begeek. Cinq minutes de lecture et zéro bruit.
Je m'abonne gratuitementÀ découvrir
La suite, sélectionnée pour vous.
Begeek · 06 Sep · 10h00
RAM défectueuse : Windows a déjà l’outil pour la détecter
Un plantage, un BSOD, des applis qui sautent ? L’outil de diagnostic mémoire de Windows peut vérifier votre RAM, mais ses résultats ne sont pas toujours visibles.
Begeek · 06 Sep · 8h00
Tweet.app : le nouveau visage de Twitter.now
La plateforme lancée sous Twitter.now change déjà de nom après une première décision de justice. Mais elle garde un vrai morceau de l’héritage Twitter.
Begeek · 05 Sep · 16h00
Avec GPT-6 Astra, OpenAI pousse l’IA agentique à un nouveau niveau
OpenAI lance GPT-6 Astra, un modèle taillé pour l’action sur ordinateur. Plus fort en code et cybersécurité, il relance aussi les questions de sécurité.
Begeek · 05 Sep · 14h00
Le marché du CD repart à la hausse
Les ventes de CD remontent nettement en 2026, après une vraie baisse l’an dernier. Derrière ce rebond, on voit surtout le retour en grâce de la tech plus simple.
Begeek · 04 Sep · 16h00
Des grimpeurs se perdent après avoir suivi les conseils de Gemini
Des grimpeurs ont préparé l’ascension du mont Shasta avec Gemini. Mauvais calcul, mauvais matériel, puis une opération de secours très longue.
Begeek · 04 Sep · 14h00
OpenAI : Astra inquiète déjà les chercheurs en sécurité de l’IA
Le futur modèle Astra d’OpenAI utiliserait une technique qui rend le raisonnement moins lisible. Et ça crispe déjà les experts sécurité.