Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.

Anthropic et OpenAI, deux des principaux développeurs de systèmes d'intelligence artificielle avancée, ont proposé de créer des évaluateurs IA intégrés destinés à aider à gérer le risque que des modèles de plus en plus puissants ne causent un préjudice catastrophique à la société, selon un rapport publié par CNBC le 16 septembre.
Le rapport décrit ce concept comme une forme de mécanisme de surveillance « neutre », dans lequel les évaluateurs seraient intégrés ou étroitement liés au processus de développement des modèles d'IA, plutôt que de fonctionner comme des gardiens entièrement externes ou indépendants.
Selon CNBC, la proposition vise à répondre aux préoccupations croissantes des chercheurs, des décideurs politiques et du public concernant le potentiel des systèmes d'IA avancés à causer des préjudices importants, que ce soit par une utilisation abusive, un comportement involontaire ou d'autres modes de défaillance à mesure que la technologie devient plus puissante.
Cependant, le rapport de CNBC indique que l'idée a suscité du scepticisme, avec des questions soulevées quant à savoir si des évaluateurs intégrés au sein des entreprises ou étroitement affiliés à celles qui développent la technologie peuvent fournir le type d'évaluation indépendante et impartiale que nécessiterait une surveillance efficace.
Le rapport ne précise pas davantage les détails techniques ou structurels de la proposition, ni n'identifie des individus spécifiques d'Anthropic ou d'OpenAI qui ont présenté le plan. La couverture de CNBC situe cette initiative dans le cadre d'un débat plus large et continu sur la façon dont l'industrie de l'IA, les régulateurs et les experts externes devraient collaborer — ou maintenir une séparation — en ce qui concerne l'évaluation de la sécurité des systèmes d'IA de pointe.
Anthropic et OpenAI sont tous deux des développeurs éminents de modèles d'IA à grande échelle et ont précédemment exprimé publiquement leur engagement envers la recherche en matière de sécurité de l'IA. Les déclarations directes de ces entreprises sur les spécificités de la proposition d'évaluateurs n'ont pas été détaillées dans les reportages disponibles.
Ce débat intervient dans un contexte d'attention mondiale soutenue à la gouvernance de l'IA, alors que les gouvernements et les groupes industriels évaluent diverses cadres de surveillance et de réglementation des systèmes d'IA avancés.
Sources
- Anthropic, OpenAI proposed new 'neutral' AI watchdogs. Why you should worry about the idea — CNBC — Top News
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.
Les dirigeants de l'IA divisés sur le rythme du développement alors que les préoccupations en matière de sécurité s'amplifient
Dario Amodei d'Anthropic appelle à un contrôle indépendant des systèmes d'intelligence artificielle, tandis que Jensen Huang de Nvidia exhorte les entreprises à accélérer le développement, selon un rapport de l'Agence Anadolu.

Le PDG d'OpenAI affirme que le public a « raison d'avoir peur » de l'IA, plaide pour la confiance envers les développeurs
Sam Altman et d'autres cadres technologiques affirment que des incitations à la sécurité existent au sein des entreprises d'IA, alors que les préoccupations s'intensifient quant aux risques de la technologie pour l'humanité, selon BBC Business.

Ralentir le développement de l'IA ne prévient pas les risques catastrophiques, affirme un chercheur en sécurité
David Krueger estime que la proposition de « ralentissement » du PDG d'Anthropic, Dario Amodei, est insuffisante pour résoudre les préoccupations concernant la sécurité existentielle de l'IA.
Comments
Loading comments…