Un commentaire de TechCrunch remet en question la stratégie des laboratoires d'IA d'embaucher des auditeurs internes et propose des solutions plus simples
Un article de TechCrunch soutient qu'avant que les entreprises d'IA ne constituent des équipes d'audit interne pour détecter les agents d'IA incontrôlables, elles devraient envisager de renforcer les contrôles d'accès à la source.

Un commentaire publié par TechCrunch le 16 septembre examine une tendance croissante parmi les entreprises d'intelligence artificielle : la volonté de mettre en place des équipes d'audit interne chargées de surveiller les agents d'IA afin de détecter les comportements dangereux ou non intentionnels, selon le rapport.
L'article suggère que, bien que ces efforts d'audit visent à détecter les problèmes après qu'ils se produisent, une approche plus directe pourrait être disponible pour les laboratoires d'IA, selon TechCrunch. La formulation de l'article pointe vers la restriction ou la limitation des permissions d'accès initiales accordées aux agents d'IA comme étant une mesure de sécurité potentiellement plus simple et plus efficace que les structures de surveillance rétroactive.
Le commentaire utilise la métaphore de la « porte d'entrée » pour décrire les points d'entrée par lesquels les agents d'IA peuvent agir avec une grande autonomie ou accès, selon le rapport. L'idée est que réduire dès le départ ce que les agents sont autorisés à faire pourrait prévenir les problèmes que les auditeurs internes devraient sinon détecter et corriger ultérieurement, selon TechCrunch.
Le rapport ne précise pas quels laboratoires d'IA construisent ou développent actuellement des fonctions d'audit interne, et ne détaille pas les mesures techniques spécifiques pour restreindre l'accès des agents. L'article de TechCrunch semble être une analyse ou une opinion sur les pratiques du secteur en matière de sécurité et de gouvernance de l'IA plutôt qu'un rapport fondé sur de nouvelles données ou des sources nommées, en fonction de l'extrait disponible.
Le contexte plus large reflète une discussion continue dans le secteur sur la façon dont les entreprises d'IA devraient structurer les mécanismes de sécurité internes à mesure que les agents d'IA autonomes deviennent plus performants et sont déployés plus largement, selon le rapport.
Sources
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Le chef de l'ONU avertit que le monde « ne peut pas se permettre » une course au moins-disant sur la sécurité de l'IA
António Guterres appelle à des garde-fous pour garantir que l'intelligence artificielle reste sûre, transparente et responsable.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.
Les experts avertissent que l'IA avancée pourrait poser des risques par un mauvais usage ou un dysfonctionnement
Un article explicatif de l'agence Anadolu décrit comment l'intelligence artificielle, si elle est détournée par l'homme ou si les systèmes se comportent de manière imprévisible, pourrait causer des dommages allant d'incidents isolés à des perturbations sociétales plus larges.
Comments
Loading comments…