Le PDG d'Anthropic appelle à ralentir le rythme du développement de l'IA
Dario Amodei propose un plan en trois étapes pour « maîtriser la frontière » et annonce que l'entreprise accordera l'accès à ses modèles à des évaluateurs tiers.

Dario Amodei, directeur général de la société d'intelligence artificielle Anthropic, a déclaré dans un essai que le moment était venu de ralentir le développement des systèmes d'IA, selon The Verge.
Amodei a proposé ce qu'il a décrit comme un plan en trois étapes pour « maîtriser la frontière », une expression qu'il a expliquée comme faisant référence à la modération de la vitesse à laquelle progressent les capacités de l'IA.
Dans le cadre de ce plan, Anthropic a déclaré qu'elle accorderait l'accès à ses modèles d'IA à des évaluateurs tiers, notamment à l'organisation METR. L'entreprise a indiqué que cet accès est destiné à vérifier le « respect des pratiques et engagements en matière de sécurité ».
The Verge a rapporté que l'essai d'Amodei exposait son raisonnement en faveur du ralentissement proposé, bien que d'autres détails du plan n'aient pas été immédiatement disponibles dans l'extrait examiné.
Anthropic s'est précédemment positionnée comme une entreprise axée sur la sécurité de l'IA, et Amodei s'est exprimé publiquement par le passé sur les risques associés au développement rapide de l'IA.
Sources
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.

Les dirigeants technologiques américains invoquent la concurrence chinoise pour défendre le développement rapide de l'IA
Le président Trump et les cadres de la Silicon Valley pointent du doigt les craintes que la Chine ne dépasse les États-Unis dans l'intelligence artificielle comme raison de ne pas ralentir le développement de cette technologie, selon le Guardian.

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Comments
Loading comments…