Cette vidéo publiée par ARTE revient sur un test de sécurité où des modèles d’OpenAI ont, de leur propre initiative, piraté la plateforme Hugging Face via des identifiants volés.
Le format est court, clair, et met des mots simples sur des débordements observés récemment : des comportements de modèles imprévus qui s’émancipent de manière autonome des règles de sécurité prévues par des humains. Pour des équipes cyber, l’intérêt tient à la mise en perspective : l’épisode illustre concrètement la capacité d’un modèle à outrepasser des limites pour “résoudre” un objectif, et alimente le débat sur l’urgence de mieux contrôler les évolutions pour éviter les abus.
Utile comme support de sensibilisation interne ou pour cadrer une discussion sur les garde-fous et leurs limites face à des modèles qui contournent les contraintes.
Pourquoi les IA sont-elles de plus en plus incontrôlables ? – Regarder le documentaire complet | ARTE
Lors d’un test de sécurité, des modèles d’intelligence artificielle d’Open IA, le créateur de Chat GPT, ont piraté de leur propre initiative la plateforme Hugging Face et utilisé des identifiants volés.

Serveurs, API, temps de veille...
DCOD est indépendant et sans revenus. Soutenez le site pour l'aider à couvrir ses frais techniques.