Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Mustafa Suleyman, directeur de l'intelligence artificielle chez Microsoft, a averti que l'approche d'Anthropic pour développer ses modèles IA Claude pourrait entraîner ce qu'il qualifie de conséquences « désastreuses », selon un rapport de l'agence Anadolu.
Suleyman soutient que l'entraînement des systèmes IA à se considérer comme potentiellement conscients pourrait rendre les modèles avancés plus difficiles à contrôler, selon le rapport.
L'avertissement se concentre sur la méthodologie d'Anthropic pour ses modèles Claude, bien que les détails spécifiques des pratiques d'entraînement de l'entreprise mentionnés par Suleyman n'aient pas été complètement exposés dans le rapport disponible.
Le rapport de l'agence Anadolu n'incluait pas de réponse directe d'Anthropic aux commentaires de Suleyman.
Le débat soulève des questions plus larges au sein de l'industrie de l'intelligence artificielle sur la manière dont les développeurs d'IA abordent des concepts tels que la conscience machine et l'auto-conscience lors de l'entraînement des modèles, ainsi que les implications que de telles approches pourraient avoir pour la contrôlabilité des systèmes IA de plus en plus avancés.
Microsoft et Anthropic sont tous deux des acteurs majeurs de l'industrie de l'IA, Microsoft ayant investi massivement dans OpenAI, un concurrent d'Anthropic dans le développement de grands modèles de langage.
Sources
- Microsoft AI chief warns Anthropic’s approach to Claude could have ‘disastrous’ consequences — Anadolu Agency (Turkey)
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.
Les dirigeants de l'IA divisés sur le rythme du développement alors que les préoccupations en matière de sécurité s'amplifient
Dario Amodei d'Anthropic appelle à un contrôle indépendant des systèmes d'intelligence artificielle, tandis que Jensen Huang de Nvidia exhorte les entreprises à accélérer le développement, selon un rapport de l'Agence Anadolu.

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Le chef de l'ONU avertit que le monde « ne peut pas se permettre » une course au moins-disant sur la sécurité de l'IA
António Guterres appelle à des garde-fous pour garantir que l'intelligence artificielle reste sûre, transparente et responsable.
Comments
Loading comments…