Ralentir le développement de l'IA ne prévient pas les risques catastrophiques, affirme un chercheur en sécurité
David Krueger estime que la proposition de « ralentissement » du PDG d'Anthropic, Dario Amodei, est insuffisante pour résoudre les préoccupations concernant la sécurité existentielle de l'IA.

David Krueger, chercheur en sécurité, affirme que ralentir le développement de l'IA d'un à deux ans—une proposition soutenue par le PDG d'Anthropic Dario Amodei, Sam Altman et Elon Musk—ne répond pas adéquatement aux risques des systèmes d'IA avancés. Selon Krueger, les experts ont depuis longtemps compris que les entreprises d'IA manquent de mécanismes de contrôle suffisants pour ces systèmes, et le ralentissement seul ne peut pas éliminer cette vulnérabilité fondamentale.
La critique de Krueger fait suite à la démission de Jacob Coxon d'Anthropic, que Krueger considère comme marquant un tournant dans la prise de conscience publique des enjeux de sécurité de l'IA. Il soutient que l'industrie a besoin d'un plan concret pour garantir que les systèmes d'IA restent contrôlables, plutôt qu'un ralentissement proposé du rythme de développement.
Sources
- ‘Pacing’ won’t eliminate the risk of AI doom. Here’s what could | David Krueger — The Guardian — Business
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.
Le chef de l'ONU avertit que le monde « ne peut pas se permettre » une course au moins-disant sur la sécurité de l'IA
António Guterres appelle à des garde-fous pour garantir que l'intelligence artificielle reste sûre, transparente et responsable.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.
Les experts avertissent que l'IA avancée pourrait poser des risques par un mauvais usage ou un dysfonctionnement
Un article explicatif de l'agence Anadolu décrit comment l'intelligence artificielle, si elle est détournée par l'homme ou si les systèmes se comportent de manière imprévisible, pourrait causer des dommages allant d'incidents isolés à des perturbations sociétales plus larges.
Comments
Loading comments…