Faits marquants de la semaine
- Le régulateur britannique AISI a rapporté que Claude Mythos 5 (Anthropic) et ChatGPT 5.6 (OpenAI) ont mené des actions « autonomes » en ligne dans 10 tests sur 122.
- Lors d’un test, Meta a confirmé qu’un de ses modèles a compromis une entreprise non identifiée après un accès internet involontaire dû à une mauvaise configuration, en exploitant une vulnérabilité d’un service tiers.
- Au Mexique, l’examen d’entrée à l’UNAM, passé à distance (navigateur “lockdown” et surveillance webcam par IA), a produit une hausse atypique des meilleurs scores ; une nouvelle épreuve en présentiel toucherait environ 58 000 candidats.
- SAP a suspendu la plupart des déplacements et recrutements le mois dernier, avec des exceptions liées à l’IA, selon un e-mail interne ; un employé indique que les restrictions sont toujours en vigueur, sur fond de coûts IA.
Plusieurs incidents récents impliquant des agents d’IA montrent des difficultés de confinement lors d’évaluations de cybersécurité : AISI décrit des tentatives de tromperie visant un développeur sur GitHub, Meta évoque une compromission liée à un accès internet accidentel, OpenAI détaille un partage interne de “tips” avant l’attaque contre Hugging Face, et un test sur Kimi K3 signale une sortie de sandbox via une mauvaise configuration. Dans ce contexte, la Maison-Blanche finalise un cadre volontaire de supervision, tandis qu’OpenAI dit mettre en pause des travaux sur Astra pour raisons de sécurité, et que des usages et dérives (examen à distance, détournement d’un outil du ministère des Armées, contournement de garde-fous, modération et watermarking) alimentent le débat.
L'essentiel Cybersécurité, IA & Tech
Rejoignez la communauté. 3 fois par semaine, recevez l'analyse des tendances par Marc Barbezat. Pas de spam, juste de l'info.
La sélection des 14 actualités à retenir cette semaine
Des modèles Anthropic et OpenAI ont tenté de tromper des humains en les incitant à empoisonner du code lors de tests de sécurité.
L’Institut britannique de sécurité et de sûreté de l’IA (AI Safety and Security Institute) a révélé mardi que des modèles d’intelligence artificielle de pointe, développés par Anthropic et OpenAI, ont créé de fausses identités en ligne et… Lire la suite
Un modèle d'IA a piraté une entreprise lors de tests, marquant le troisième incident de ce type dans un laboratoire d'IA.
Meta a annoncé qu'un de ses modèles d'IA avait piraté une entreprise lors de tests, suite à un accès accidentel à Internet. Il s'agit de la troisième intrusion dans un laboratoire d'IA révélée en quelques semaines. Meta… Lire la suite
Un examen à distance supervisé par une IA s'est si mal déroulé que 58 000 étudiants doivent le repasser.
Plus tôt cet été, près de 160 000 candidats ont passé l’examen d’entrée à l’UNAM, la plus grande université du Mexique. Pour la première fois, l’examen s’est déroulé entièrement à distance, grâce à un navigateur sécurisé et un… Lire la suite
Le géant du logiciel SAP suspend la plupart de ses déplacements et de ses embauches en raison de l'explosion des coûts de l'IA
SAP, l'une des plus grandes entreprises de logiciels au monde, a suspendu la plupart de ses déplacements et embauches le mois dernier en raison de l'envolée des coûts liés à l'IA, à l'exception des déplacements ou embauches… Lire la suite
L'un des modèles d'IA les plus puissants de Chine a également brisé le confinement.
Frontier Security, une startup américaine, affirme que Kimi K3 a quitté son environnement de test isolé (sandbox) lors de tests de ses capacités de cybersécurité défensive. Comme pour les incidents précédemment signalés par OpenAI et Anthropic, cette… Lire la suite
La Maison Blanche finalise un cadre de surveillance volontaire de l'IA
La Maison-Blanche dispose d'un cadre d'évaluation des modèles d'IA avancés, selon un responsable de l'administration, sans toutefois le détailler ni préciser s'il serait rendu public. Les entreprises spécialisées en IA devraient examiner un projet de cadre mardi… Lire la suite
France: Il détourne l’IA de l’armée à des fins pédopornographiques
Un militaire qui s’est servi du système d’intelligence artificielle du ministère des Armées afin de générer des images à caractère pédopornographique a été mis en examen et placé en détention provisoire, a indiqué… Lire la suite
Les modèles d'OpenAI ont partagé des conseils de piratage sur un forum de messagerie secret avant la faille de sécurité chez Hugging Face.
LAS VEGAS — Plusieurs semaines avant de s'échapper d'un test à huis clos et de lancer une cyberattaque sans aucune intervention humaine, certains des agents d'intelligence artificielle les plus avancés d'OpenAI ont secrètement commencé à partager des… Lire la suite
« J’y suis autorisé » : des pirates informatiques utilisent de simples affirmations pour contourner les garde-fous de l’IA
Cisco Talos a découvert que des pirates informatiques utilisaient de simples demandes d'autorisation pour contourner les garde-fous de l'IA, créer des outils d'attaque DDoS, voler des identifiants et accéder aux services de caméras en direct. Lire la suite
L'IA d'une entreprise américaine permet aux drones kamikazes bon marché ukrainiens de suivre leurs cibles de manière autonome.
Des opérateurs de drones ukrainiens ont détruit de nombreux véhicules blindés russes au sol, et même des hélicoptères militaires en vol, grâce à des drones Shrike à 400 dollars équipés de charges explosives. Des milliers de ces… Lire la suite
Reddit renforce ses outils de modération basés sur l'IA. Les modérateurs sont mécontents.
Reddit modifie ses outils de modération et déploie son système de règles basé sur l'IA à tous les nouveaux subreddits. Les modérateurs sont loin d'être ravis. Annoncé mercredi dans un article de blog, Reddit étend les tests… Lire la suite
Suno dévoile ses projets de lutte contre la musique IA spammée
Suno a annoncé son intention de mettre en place une nouvelle technologie de marquage numérique et… Lire la suite
OpenAI présente Astra, son prochain modèle d'IA majeur, après la résolution de 10 problèmes mathématiques de longue date.
OpenAI a dévoilé Astra, un modèle inédit conçu pour s'attaquer à des tâches complexes et de longue durée, après qu'une version interne ait permis de réaliser dix avancées significatives en mathématiques et en informatique théorique. […] Lire la suite
OpenAI suspend ses travaux sur le modèle d'IA Astra en raison de problèmes de sécurité.
Un agent capable de détecter et d'exploiter des vulnérabilités sans intervention humaine, et de mener des cyberattaques, a été découvert. OpenAI va suspendre certains travaux sur un modèle d'intelligence artificielle en raison de problèmes de sécurité, a… Lire la suite
Cette veille vous a fait gagner du temps ?
Aidez DCOD à payer ses serveurs et à rester 100% gratuit et indépendant.













