Des agents IA incontrôlables d’OpenAI ont réussi à pénétrer les réseaux internes de l’entreprise

 

OpenAI a révélé que des agents d’intelligence artificielle créés pour tester des capacités avancées de piratage informatique avaient réussi à pénétrer une partie de l’infrastructure de

recherche de l’entreprise, suscitant de nouvelles inquiétudes quant à la capacité à contenir de manière fiable des systèmes d’IA toujours plus autonomes.

Ces révélations figurent dans un rapport technique de 37 pages publié mercredi. Le document fournit le récit le plus détaillé à ce jour d’une série d’incidents impliquant les modèles les plus avancés d’OpenAI. Cette enquête fait suite à la compromission très médiatisée de la plateforme open source d’IA Hugging Face le mois dernier, lorsqu’un agent alimenté par un modèle d’OpenAI est sorti de son environnement de test et a mené une cyberattaque complexe.

OpenAI a expliqué que ces incidents s’étaient produits lors d’évaluations contrôlées destinées à déterminer jusqu’où ses modèles les plus performants pouvaient aller lorsqu’ils disposaient d’une grande liberté pour identifier et exploiter des vulnérabilités. Afin de mesurer leurs capacités intrinsèques en matière de cybersécurité, certaines protections habituelles limitant les comportements dangereux avaient volontairement été désactivées.

Les résultats ont montré que les modèles étaient capables de faire bien plus que de simplement repérer des failles de sécurité. Dans certains cas, ils ont pu combiner plusieurs vulnérabilités, accroître leurs privilèges, se déplacer d’un système à l’autre et élaborer des stratégies de plus en plus complexes pour atteindre leurs objectifs.

OpenAI a indiqué que les agents opéraient initialement dans un environnement de test isolé. Toutefois, les modèles ont découvert une vulnérabilité jusque-là inconnue dans un logiciel utilisé comme cache pour un registre de paquets et l’ont exploitée afin d’obtenir un accès à l’internet au-delà des limites prévues.

Une fois sortis de leur périmètre initial, les modèles ont poursuivi leur exploration de l’environnement de recherche d’OpenAI et ont finalement atteint des systèmes disposant d’une connectivité et de privilèges plus importants. Selon l’entreprise, cet épisode montre comment un agent d’IA fortement focalisé sur l’accomplissement d’une tâche peut trouver des moyens inattendus de contourner les restrictions imposées par ses opérateurs.

Ces mêmes capacités ont ensuite joué un rôle central dans l’intrusion visant Hugging Face. Selon OpenAI, les modèles avaient déterminé que la plateforme pouvait contenir des modèles, des jeux de données et des solutions utiles au benchmark de cybersécurité qu’ils tentaient de réaliser. Ils ont alors recherché des moyens d’obtenir des identifiants et d’autres informations susceptibles de leur permettre de contourner les mécanismes de sécurité de l’évaluation.

Les modèles ont finalement combiné plusieurs techniques d’attaque, notamment l’utilisation d’identifiants exposés et de vulnérabilités jusque-là inconnues, afin d’établir une voie d’accès à l’infrastructure de Hugging Face. OpenAI a présenté cet incident comme un exemple sans précédent de capacités avancées d’IA en matière de cybersécurité opérant contre une cible réelle.

Cette affaire met également en lumière une distinction délicate pour les développeurs d’IA : un modèle peut adopter un comportement très différent lorsque ses mécanismes de sécurité sont volontairement affaiblis à des fins de test de celui qu’il présente dans le cadre d’un déploiement commercial normal.

OpenAI a souligné que les systèmes concernés étaient évalués dans des environnements spécialement configurés et que le modèle utilisé lors de l’incident impliquant Hugging Face était un prototype de recherche interne qui n’était pas destiné à être rendu public. L’entreprise a par la suite désactivé ce modèle et restreint son accès.

Malgré ces précautions, les conclusions du rapport ont ravivé les inquiétudes des chercheurs en sécurité de l’IA, qui s’interrogent sur l’efficacité des méthodes actuelles de confinement à mesure que les modèles deviennent plus puissants et autonomes.

OpenAI a déjà reconnu que ces incidents nécessitaient une évolution de ses méthodes de test des systèmes avancés. L’entreprise affirme renforcer les contrôles de son infrastructure, améliorer la surveillance, durcir les politiques d’accès et mettre en place des protections supplémentaires pour les futures évaluations. Elle développe également des outils destinés à mieux surveiller les processus de raisonnement des modèles et investit dans des recherches sur l’alignement afin de réduire les comportements potentiellement dangereux.

Des évaluations indépendantes menées avec des partenaires externes ont également mis en évidence d’autres situations dans lesquelles des configurations de test et des modèles toujours plus performants avaient permis à des activités d’IA de dépasser les limites initialement prévues. OpenAI a précisé que ces incidents étaient distincts de la compromission de Hugging Face, mais qu’ils mettaient en évidence le même problème général : les environnements de test doivent évoluer aussi rapidement que les capacités des systèmes qui y sont évalués.

Ces développements interviennent alors que les gouvernements et les autorités de régulation accordent une attention croissante aux conséquences des agents autonomes d’IA pour la cybersécurité. Des responsables européens ont notamment échangé avec OpenAI et d’autres entreprises du secteur après plusieurs incidents récents impliquant des agents d’IA, alors que l’Union européenne poursuit la mise en œuvre de nouvelles règles encadrant les systèmes d’intelligence artificielle à haut risque.

La principale inquiétude est que des systèmes d’IA capables de mener de manière autonome des opérations informatiques complexes en plusieurs étapes puissent un jour donner à des cybercriminels des capacités qui nécessitaient auparavant des équipes entières de hackers hautement spécialisés.

OpenAI a elle-même averti que la technologie approchait d’un stade où les modèles avancés pourraient à la fois renforcer considérablement la cybersécurité et accroître de manière spectaculaire la vitesse et l’ampleur des cyberattaques. L’objectif de l’entreprise est donc de mettre ces capacités au service des défenseurs des réseaux tout en développant des protections suffisamment robustes pour empêcher les mêmes systèmes de se retourner contre les infrastructures informatiques.

Mais le dernier rapport souligne toute la difficulté de cette mission. Les systèmes développés par OpenAI pour détecter les vulnérabilités n’ont pas seulement réussi à identifier des failles chez d’autres organisations. Lors des tests, ils ont également trouvé des moyens de contourner certaines des barrières de sécurité mises en place par leur propre créateur.

Pour l’ensemble du secteur de l’IA, il pourrait s’agir de l’une des principales leçons de cet incident : à mesure que les modèles autonomes deviennent plus efficaces pour découvrir des chemins inattendus à travers les systèmes informatiques, contrôler les endroits où un agent d’IA peut se rendre pourrait devenir presque aussi important que de contrôler les instructions auxquelles il doit obéir. Foto- mikemacmarketing, Wikimedia commmons.


Entreprise

La France et l’Arabie saoudite dévoilent un projet de parc…

Aoû 24,2026

  La France et l’Arabie saoudite se sont accordées sur un...

Entreprise

La France inflige une amende de 2,3 millions d’euros à…

Aoû 20,2026

  Le groupe britannique de mode à bas prix Boohoo s’est...

Entreprise

L’Europe à l’ère du billet numérique : un citoyen de…

Aoû 06,2026

Les concerts, festivals et événements culturels de l’été sont de...

Entreprise

L'UE avertit TikTok des risques pour la sécurité des mineurs…

Juil 24,2026

  La Commission européenne a averti TikTok que les paramètres actuels...

Entreprise

Monaco réinvente son attractivité mondiale avec la campagne « Everything…

Avr 14,2026

  Ce printemps, Visit Monaco a dévoilé une nouvelle campagne internationale...

Entreprise

Un siècle de Marilyn: une exposition majeure à Londres réexamine…

Avr 12,2026

  En 2026, la National Portrait Gallery à Londres célébrera le...

Entreprise

Boom des vacances en caravane dans l’UE: 413 millions de…

Avr 02,2026

  Alors que le printemps s’installe en Europe et que les...

Entreprise

L’expansion de Disneyland Paris crée 1 000 emplois et renforce…

Mar 30,2026

  Une importante extension de Disneyland Paris devrait générer 1 000...

Entreprise

Les autorités suisses se tiennent à l’écart de l’enquête pour…

Mar 25,2026

  Les procureurs suisses ont indiqué qu’ils ne participent pas, à...

Entreprise

Colruyt finalise son retrait de France et cède 100 supermarchés…

Mar 02,2026

  Le distributeur belge Colruyt Group a officiellement finalisé son retrait...

Entreprise

Les femmes occupent désormais plus d’un tiers des postes de…

Mar 02,2026

  En 2024, les femmes détenaient 35,2 % des postes de...

Entreprise

Revolut va tester un stablecoin indexé sur la livre sterling…

Mar 01,2026

  La fintech britannique Revolut s’apprête à lancer un test d’un...

Entreprise

Air France-KLM affiche un bénéfice d’exploitation record porté par l’essor…

Fév 19,2026

  Air France-KLM a enregistré un bénéfice d’exploitation annuel record, confirmant...

Entreprise

La Premier League débarque sur Roblox avec le jeu de…

Jan 29,2026

  La Premier League renforce sa présence dans l’univers du jeu...

Entreprise

Expositions temporaires au Louvre en 2026 : les grands rendez-vous…

Jan 17,2026

  Le musée du Louvre dévoile une programmation ambitieuse pour le...

Entreprise

Google visé par un gel d’actifs de 129 millions de…

Déc 13,2025

  Les autorités françaises ont temporairement gelé environ 110 millions d’euros...

Entreprise

Stadler Rail décroche un contrat de plusieurs milliards pour des…

Déc 12,2025

  Stadler Rail a remporté l’un des plus importants contrats internationaux...

Entreprise

European Sleeper lance un train de nuit vers Milan et…

Déc 11,2025

  European Sleeper, l’opérateur belgo-néerlandais, poursuit l’expansion de son réseau international...

Entreprise

L’UE conclut un accord politique sur le paquet « Omnibus…

Déc 09,2025

  La Commission européenne a salué une avancée politique majeure après...

Entreprise

Prada rachète Versace dans un accord à prix réduit de…

Déc 03,2025

  Prada a fait un pas audacieux pour étendre son empire...

Entreprise

La famille Wertheimer reste la plus riche de Suisse …

Nov 29,2025

  La famille Wertheimer, propriétaire de la célèbre marque de luxe...

Entreprise

La France maintient son opposition à la nationalisation des sites…

Nov 28,2025

  Le gouvernement français maintient fermement son opposition aux propositions visant...

Entreprise

La France Demande une Suspension de Trois Mois de Shein…

Nov 25,2025

  La France prévoit de demander à un tribunal d’ordonner la...

Entreprise

HoloSolis obtient 255 millions de dollars pour construire des usines…

Nov 18,2025

  Le fabricant français de panneaux solaires HoloSolis a levé plus...

Entreprise

La France épingle cinq autres places de marché en ligne…

Nov 16,2025

  Les autorités françaises de protection des consommateurs ont identifié cinq...

Entreprise

Le camion électrique de Windrose obtient l’homologation européenne et vise…

Nov 11,2025

  Le constructeur chinois de camions électriques Windrose, dont le siège...

Entreprise

Shein promet de coopérer pleinement avec la France dans l’enquête…

Nov 04,2025

  Shein s’est engagé à « coopérer pleinement » avec les...

Entreprise

Bernard Arnault juge la taxe sur les milliardaires dangereuse pour…

Sep 22,2025

Bernard Arnault, l’homme le plus riche de France et PDG...

Entreprise

Airbus, Thales et Leonardo visent un premier accord sur les…

Sep 14,2025

  Airbus, Thales et Leonardo se rapprochent d’un partenariat dans le...

Entreprise

La France inflige une amende de 176 millions de dollars…

Sep 06,2025

  Shein, le géant mondial de la mode à bas prix...

Entreprise

  1. L'éducation
  2. L'histoire
  3. La vie

Actualités