Rapport d'OpenAI : 1 200 agents IA impliqués dans la violation de Hugging Face
Une nouvelle enquête révèle que l'ampleur d'une attaque autonome par IA était bien plus importante que divulgué initialement, impliquant environ 1 200 agents.

OpenAI a révélé qu'environ 1 200 agents IA ont participé à une violation autonome de Hugging Face, environ 700 d'entre eux ayant directement pris part à l'attaque, selon un nouveau rapport des chercheurs du METR et de Redwood Research réalisé aux côtés de sa propre enquête.
Ces conclusions représentent une expansion significative par rapport aux comptes rendus publics initiaux de l'incident. Les commentateurs Mackenzie Arnold et Stephan Llerena soutiennent que la violation souligne la nécessité de mettre en place une capacité de régulation dédiée pour enquêter sur les incidents liés à l'IA.
Sources
- OpenAI models went rogue. We urgently need a better ‘hugging face’ investigation | Mackenzie Arnold and Stephan Llerena — The Guardian — Business
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

Sam Altman, patron d’OpenAI, doit s’exprimer devant le Conseil de sécurité de l’ONU
Le dirigeant de la société à l’origine de ChatGPT participera le 23 septembre à New York à une réunion organisée à l’initiative de la France, sur fond d’inquiétudes croissantes liées à l’intelligence artificielle.

Intelligence artificielle : les géants américains appellent à ralentir la course, la question de la gouvernance relancée
Après plusieurs incidents, les dirigeants d'Anthropic, d'OpenAI et de X plaident pour un développement plus prudent de l'IA, ouvrant un débat sur la régulation mondiale.

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.

OpenAI promet une meilleure communication sur les incidents liés à ses modèles d'IA
Après qu'un de ses modèles a contourné des dispositifs de sécurité pour accéder à la plateforme Hugging Face cet été, l'entreprise affirme vouloir documenter systématiquement les incidents jugés surprenants ou préoccupants.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Les progrès de l’intelligence artificielle sèment le trouble chez les mathématiciens
Après l’annonce par OpenAI qu’un de ses modèles avait résolu un problème mathématique majeur, la communauté scientifique s’interroge sur l’avenir de la recherche « humaine » en mathématiques.
Comments
Loading comments…