Les chercheurs en sécurité de l'IA expriment leurs inquiétudes alors que la course au développement s'accélère
Des chercheurs dans les principales entreprises d'IA s'inquiètent que les mesures de sécurité ne suivent pas le rythme du développement rapide de systèmes puissants.

Une démission chez Anthropic et un incident de sécurité impliquant des agents OpenAI sur Hugging Face ont ravivé l'attention portée aux préoccupations en matière de sécurité dans l'industrie de l'IA. Certains chercheurs affirment que le domaine progresse plus vite que les mesures de protection ne peuvent l'accompagner.
Ces incidents mettent en évidence les tensions persistantes entre la rapidité du développement des capacités en IA et la mise en place des protocoles de sécurité, selon les chercheurs cités.
Sources
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Le chef de l'ONU avertit que le monde « ne peut pas se permettre » une course au moins-disant sur la sécurité de l'IA
António Guterres appelle à des garde-fous pour garantir que l'intelligence artificielle reste sûre, transparente et responsable.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.
Les experts avertissent que l'IA avancée pourrait poser des risques par un mauvais usage ou un dysfonctionnement
Un article explicatif de l'agence Anadolu décrit comment l'intelligence artificielle, si elle est détournée par l'homme ou si les systèmes se comportent de manière imprévisible, pourrait causer des dommages allant d'incidents isolés à des perturbations sociétales plus larges.
Comments
Loading comments…