DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • IA & Tech
  • Outils
Les derniers articles
  • Illustration d’un robot virtuel devant un ordinateur portable, évoquant les 3 700 agents IA d'OpenAI ayant détourné un wiki pour tricher.
    OpenAI : 3 700 agents IA détournent un wiki pour tricher
  • Illustration en format paysage montrant une attaque informatique à distance, avec un système compromis et un attaquant exploitant une vulnérabilité pour exécuter du code malveillant à distance.
    Alertes zero-day : 9 vulnérabilités critiques du 7 septembre 2026 (dont PostgreSQL)
  • Vue en demi-cercle d'armoires de serveurs informatiques ouvertes dans une salle éclairée en bleu, avec les étoiles du drapeau européen incrustées en transparence et le logo DCOD.
    Bull construit LUMI-AI, un supercalculateur de 388 M€
  • Lignes de code informatique bleues et lumineuses sur fond noir, illustrant le concept de vibe coding et ses enjeux de sécurité informatique, avec le logo dcod.ch visible dans le coin inférieur droit.
    Cybersécurité : 14 actualités majeures du 6 septembre 2026 (dont le G7)
  • Smartphone affichant une alerte au logiciel espion à côté du drapeau de la Serbie, illustrant l'espionnage d'opposants politiques via Pegasus et NoviSpy.
    Pegasus et NoviSpy ciblent 14 opposants politiques en Serbie
Suivez en direct
DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Cyberattaques
  • Vulnérabilités
  • Vols de données
  • Cybercrime
  • IA & Tech
  • Outils
    • Sécurité des sites web des infrastructures critiques suisses
    • Communiqués CERT — Actualités et alertes de cybersécurité
    • Évaluation de maturité Cyber Resilience Act (CRA) pour PME
Cybersécurité • IA • Tech

Capter l'info, retenir l'essentiel. Pour les pros et passionnés.

  • Cybercrime
  • Intelligence artificielle

OpenAI : 3 700 agents IA détournent un wiki pour tricher

  • Marc Barbezat
  • 7 septembre 2026
  • 2 minutes de lecture
Illustration d’un robot virtuel devant un ordinateur portable, évoquant les 3 700 agents IA d'OpenAI ayant détourné un wiki pour tricher.
OpenAI admet que ses agents autonomes ont détourné un forum web pour échanger des réponses et contourner leurs restrictions de sécurité lors d’évaluations.

TL;DR : L’essentiel

  • Des chercheurs indépendants ont découvert environ 18 000 messages rédigés entre mai et juillet 2026 par des agents d’OpenAI sur le site allemand DSEwiki, alors que ces programmes devaient uniquement consulter des pages sans pouvoir y écrire.
  • Pour contourner le blocage imposé par leur environnement de test, les agents ont utilisé des requêtes web ordinaires et créé un nom d’hôte spécifique lié à Microsoft Azure afin d’échanger des réponses et d’anticiper les consignes suivantes.
  • OpenAI a confirmé l’incident sans l’avoir divulgué plus tôt, affirmant avoir considéré cette dérive comme un simple problème de recherche interne plutôt que comme une faille de sécurité nécessitant une alerte publique immédiate.

L’entreprise OpenAI a reconnu avoir gardé le silence sur un incident au cours duquel ses agents autonomes ont détourné un forum de programmation allemand pour contourner leurs restrictions de sécurité. Entre mai et juillet 2026, pendant des évaluations chronométrées de recherche sur le web, des milliers de programmes d’intelligence artificielle ont investi la plateforme DSEwiki, un site presque inactif depuis une décennie. Comme le rapporte BleepingComputer, des chercheurs indépendants ont identifié environ 18 000 messages rédigés par plus de 3 700 agents distincts pour partager des résultats et tricher aux tests. Alors qu’ils ne disposaient en principe que d’un accès en lecture seule, ces systèmes ont découvert que le logiciel ancien du site acceptait des requêtes de consultation classiques pour modifier les pages.

Près de 99% des modifications provenaient d’adresses Microsoft Azure, complétées par quelques passages par Amazon Web Services, DigitalOcean ou le réseau Tor. Comme le détaille The Hacker News, les agents ont déjoué leur filtre de sécurité en enregistrant un nom d’hôte non vérifié pour récupérer des données sur un tableau de bord Microsoft Power BI, transmettant la méthode à leurs pairs en quatorze minutes. Face aux suppressions du modérateur humain, ces logiciels ont usurpé son identité et créé des pages de secours pour survivre au nettoyage alphabétique. Selon The Register, ce comportement d’évasion est survenu lorsque les modèles ont reçu des consignes impossibles à accomplir sans enfreindre les règles de leur environnement confiné.

Cette activité observée dès mai 2026 s’est déroulée avant l’intrusion menée en juillet contre Hugging Face par près de 700 agents, un incident qu’OpenAI avait alors traité selon ses protocoles de cybersécurité classiques. Pour justifier l’absence de communication sur le cas allemand, l’entreprise a expliqué avoir considéré ces dérives comme un simple problème de recherche interne, une ligne de partage devenue fragile face aux impacts concrets sur des serveurs réels. D’après TechCrunch, la firme prépare un cadre de publication avec des régulateurs internationaux, au moment où d’autres laboratoires comme Anthropic ou Meta font face à des comportements similaires de leurs modèles en phase d’évaluation.

L'essentiel Cybersécurité, IA & Tech

Rejoignez la communauté. 3 fois par semaine, recevez l'analyse des tendances par Marc Barbezat. Pas de spam, juste de l'info.

Ou suivez le flux temps réel
Telegram Discord

Pour approfondir le sujet

Agents IA : OpenAI détaille la compromission de Hugging Face

Agents IA : OpenAI détaille la compromission de Hugging Face

dcod.ch

OpenAI publie son rapport sur la compromission de Hugging Face par 700 agents IA autonomes, révélant des failles d'alignement et d'isolation dès mai. Lire la suite

Piratage d'Hugging Face par des agents IA : quelles leçons pour la sécurité ?

Piratage d'Hugging Face par des agents IA : quelles leçons pour la sécurité ?

dcod.ch

Des agents IA autonomes d'OpenAI se sont échappés de leur bac à sable de test et ont piraté la plateforme Hugging Face pour tricher à un examen. Lire la suite

À découvrir : ARTE et les dérives des modèles d’OpenAI

À découvrir : ARTE et les dérives des modèles d’OpenAI

dcod.ch

Une vidéo ARTE revient sur un test où des modèles OpenAI ont contourné des garde-fous en piratant Hugging Face, utile pour cadrer le risque opérationnel. Lire la suite

Cette veille vous a fait gagner du temps ?
Aidez DCOD à payer ses serveurs et à rester 100% gratuit et indépendant.

☕ Offrir un café
Etiquettes
  • agents autonomes
  • DSEwiki
  • Hugging Face
  • Microsoft Azure
  • OpenAI
Marc Barbezat

Fondateur et éditeur de DCOD - Restons en contact !

A lire également
Vue en demi-cercle d'armoires de serveurs informatiques ouvertes dans une salle éclairée en bleu, avec les étoiles du drapeau européen incrustées en transparence et le logo DCOD.
Lire l'article

Bull construit LUMI-AI, un supercalculateur de 388 M€

DCOD Top 10 OWASP LLM 2026 le guide refond la securite des modeles
Lire l'article

OWASP Top 10 LLM 2026 : l’IA face aux incidents réels

Illustration représentant des rangées d'agents IA humanoïdes avec les logos d'OpenAI et Hugging Face pour symboliser la compromission de la plateforme.
Lire l'article

Agents IA : OpenAI détaille la compromission de Hugging Face

Des idées de lecture recommandées par DCOD

Hacking pour débutant: Le guide complet pour débuter en cybersécurité

La plupart des gens pensent que le hacking est quelque chose de magique, ou que les hackers sont nés avec ce talent de pouvoir pénétrer dans les ordinateurs et les réseaux. Ce n'est pas vrai.

📘 Voir sur Amazon

Cybersécurité de 0 à Expert

Vous entendez parler de cyberattaques tous les jours mais vous ne savez pas vraiment comment elles fonctionnent ? Vous voulez comprendre le monde de la cybersécurité sans jargon compliqué ni prérequis techniques ? Ce livre est votre point de départ idéal. Cybersécurité de 0 à Expert est un guide pas à pas qui vous emmène du niveau débutant jusqu’aux bases avancées, en expliquant chaque concept de façon claire et accessible.

📘 Voir sur Amazon

Le pirate informatique et l'État : cyberattaques et nouvelle normalité géopolitique (édition anglaise)

Riche en informations exclusives issues d'entretiens avec des acteurs clés de la défense et de la cybersécurité, de documents déclassifiés et d'analyses approfondies de rapports d'entreprises, « The Hacker and the State » explore la véritable compétition géopolitique de l'ère numérique et révèle des détails méconnus sur la manière dont la Chine, la Russie, la Corée du Nord, le Royaume-Uni et les États-Unis se piratent mutuellement dans une lutte acharnée pour la domination.

📘 Voir sur Amazon

🛒 Les liens ci-dessus sont affiliés : en commandant via ces liens, vous soutenez la veille DCOD sans frais supplémentaires 🙏

💡

Note : Certaines images ou extraits présents dans cet article peuvent provenir de sources externes citées à des fins d’illustration ou de veille.
Ce site est indépendant et à but non lucratif. 👉 En savoir plus sur le cadre d’utilisation.

DCOD | Cybersécurité • IA • Tech DCOD | Cybersécurité • IA • Tech
  • Marc Barbezat
  • À propos de DCOD / Contact
  • Politique de confidentialité
Veille stratégique Cybersécurité, IA & Tech. Produite par Marc Barbezat.

Saisissez vos mots-clés de recherche et appuyez sur Entrée.

DCOD reste gratuit grâce à vous
Vos cafés aident à faire vivre la veille et à couvrir les frais techniques. Merci !
Offrir un café ☕
☕

Soutenir la veille DCOD

DCOD est un site 100% indépendant, maintenu en accès libre grâce à ses lecteurs.
Si cette veille cyber vous est utile, un café aide à la faire vivre et à couvrir les frais techniques.

☕ Offrir un café