Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Anthropic et OpenAI ont proposé d'utiliser des évaluateurs d'IA intégrés comme outil pour aider à gérer le risque que les modèles d'intelligence artificielle causent des dommages catastrophiques à la société, selon un rapport publié par CNBC.
Le rapport décrit la proposition comme une idée émergente au sein de l'industrie de l'IA visant à résoudre les préoccupations en matière de sécurité liées aux systèmes d'IA de plus en plus puissants. Selon cette approche, des évaluateurs basés sur l'IA seraient intégrés aux modèles ou systèmes pour aider à évaluer et signaler les risques potentiels avant qu'ils ne s'aggravent et ne causent des dommages importants.
Cependant, le rapport de CNBC indique que le concept fait face à des enjeux notables qui méritent un examen approfondi. Le rapport ne détaille pas l'ampleur complète de ces préoccupations dans l'extrait disponible, mais présente la proposition comme étant, bien qu'elle soit destinée à renforcer la sécurité, susceptible d'introduire de nouveaux risques ou limitations qui n'ont pas été entièrement résolus.
Anthropic et OpenAI figurent parmi les principaux développeurs de modèles d'IA avancés et ont tous deux précédemment souligné la recherche en matière de sécurité dans leurs déclarations publiques sur le développement de l'IA. Les entreprises n'ont pas été citées directement dans l'extrait disponible concernant les détails spécifiques de la proposition d'évaluateur.
Le rapport de CNBC suggère que l'industrie de l'IA au sens large et les décideurs politiques pourraient avoir besoin de peser les avantages et les inconvénients de compter sur les systèmes d'IA eux-mêmes pour surveiller d'autres systèmes d'IA en cas de risque catastrophique, un débat qui est susceptible de se poursuivre à mesure que les entreprises explorent de nouveaux cadres de sécurité.
Sources
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.
Les dirigeants de l'IA divisés sur le rythme du développement alors que les préoccupations en matière de sécurité s'amplifient
Dario Amodei d'Anthropic appelle à un contrôle indépendant des systèmes d'intelligence artificielle, tandis que Jensen Huang de Nvidia exhorte les entreprises à accélérer le développement, selon un rapport de l'Agence Anadolu.

Intelligence artificielle : les géants américains appellent à ralentir la course, la question de la gouvernance relancée
Après plusieurs incidents, les dirigeants d'Anthropic, d'OpenAI et de X plaident pour un développement plus prudent de l'IA, ouvrant un débat sur la régulation mondiale.
Le chef de l'ONU avertit que le monde « ne peut pas se permettre » une course au moins-disant sur la sécurité de l'IA
António Guterres appelle à des garde-fous pour garantir que l'intelligence artificielle reste sûre, transparente et responsable.
Comments
Loading comments…