Le PDG d'Anthropic appelle l'industrie de l'IA à ralentir et propose un plan de sécurité en trois points
Dario Amodei déclare que son entreprise accordera unilatéralement aux évaluateurs tiers un accès à ses systèmes dans le cadre d'une initiative plus large visant à modérer le développement de l'IA.

Dario Amodei, directeur général de la société d'intelligence artificielle Anthropic, a lancé samedi un appel public invitant l'industrie de l'IA à « ralentir », selon un message qu'il a publié sur les réseaux sociaux.
Dans ce message, Amodei renvoie à un essai intitulé « We Must Pace the Frontier » (« Nous devons maîtriser le rythme de la frontière »), dans lequel il détaille un plan en trois points destiné à modérer l'accélération du développement de l'IA, selon la source.
Amodei a indiqué qu'Anthropic s'engagerait « unilatéralement » dans la première étape du plan, qui consiste à accorder « aux évaluateurs tiers un accès permanent au niveau des employés » aux systèmes d'IA de l'entreprise, selon l'essai.
Selon cet extrait, cet accès permettrait aux évaluateurs de « vérifier le respect de nos mesures de sécurité, signaler les incidents et évaluer l'alignement des modèles durant l'entraînement ».
Les composantes restantes du plan en trois points n'ont pas été détaillées dans l'extrait disponible.
Sources
- ‘We must slow the pace’: CEO of Anthropic calls for an AI slowdown — The Guardian — World
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.

Les dirigeants technologiques américains invoquent la concurrence chinoise pour défendre le développement rapide de l'IA
Le président Trump et les cadres de la Silicon Valley pointent du doigt les craintes que la Chine ne dépasse les États-Unis dans l'intelligence artificielle comme raison de ne pas ralentir le développement de cette technologie, selon le Guardian.

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Comments
Loading comments…