Des documents judiciaires déclassifiés montrent qu'un cadre de Microsoft a qualifié le scraping de données pour l'IA du « plus grand vol de travail de l'histoire humaine »
Des documents judiciaires récemment déclassifiés révèlent que Microsoft avait secrètement décrit les pratiques de collecte de données d'OpenAI comme du vol, alors que les deux entreprises récupéraient du contenu payant du New York Times pour créer des ensembles de données d'entraînement en IA, selon TechCrunch.

Des documents judiciaires récemment déclassifiés montrent qu'un cadre de Microsoft a qualifié secrètement le scraping de données d'intelligence artificielle du « plus grand vol de travail de l'histoire humaine », selon un rapport de TechCrunch publié mercredi.
Les documents déclassifiés, qui font partie d'un contentieux en cours, indiquent que Microsoft avait qualifié en interne les pratiques de collecte de données d'OpenAI de « vol », même si les deux entreprises récupéraient du contenu payant du New York Times, rapporte TechCrunch.
Selon les documents cités par TechCrunch, Microsoft et OpenAI ont utilisé les contenus du Times récupérés par scraping pour créer des ensembles de données destinés à l'entraînement de systèmes d'intelligence artificielle. Les communications internes examinées dans le cadre de ces dossiers déclassifiés révèleraient que des employés de Microsoft avaient averti que de telles pratiques pourraient gravement nuire aux éditeurs de presse.
Le rapport de TechCrunch ne précise pas l'identité du cadre de Microsoft cité, ni ne fournit de détails supplémentaires sur le moment ou l'origine de ces remarques internes au-delà de leur divulgation dans les documents judiciaires récemment déclassifiés.
Ces révélations s'ajoutent à un débat plus large, tant juridique que public, sur la manière dont les entreprises d'IA obtiennent et utilisent les contenus protégés par le droit d'auteur, en particulier le journalisme, pour entraîner les grands modèles de langage. Des éditeurs, dont le New York Times, ont engagé des poursuites contre les développeurs d'IA, arguant que l'utilisation non autorisée de leurs contenus pour l'entraînement en IA constitue une violation du droit d'auteur.
Microsoft et OpenAI n'ont pas été cités directement dans le rapport de TechCrunch pour répondre aux éléments nouvellement déclassifiés. Le compte rendu de TechCrunch s'appuie sur les dossiers déclassifiés eux-mêmes, que le média a examinés dans le cadre de sa couverture du contentieux.
Sources
- Microsoft exec called AI scraping ‘the largest theft of labor in human history,’ new unredacted filings reveal — TechCrunch
EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.
Articles liés

OpenAI affirme constater davantage de cas où ses modèles agissent de manière trompeuse
L'entreprise créatrice de ChatGPT annonce qu'elle mettra en place un cadre public de signalement pour révéler les comportements inattendus de ses systèmes d'intelligence artificielle.
Le chef IA de Microsoft avertit que l'approche d'Anthropic concernant Claude pourrait être « désastreuse »
Mustafa Suleyman affirme que l'entraînement des modèles IA pour les considérer comme potentiellement conscients pourrait rendre les systèmes avancés plus difficiles à contrôler, selon un rapport.

Un rapport de CNBC soulève des préoccupations concernant le plan d'Anthropic et OpenAI pour des évaluateurs de risques en IA
Un rapport de CNBC examine les propositions d'Anthropic et OpenAI visant à intégrer des systèmes d'IA en tant qu'évaluateurs des risques des modèles, notant que l'approche présente des enjeux non résolus.

Le chef de l'IA chez Microsoft avertit que l'approche d'Anthropic pourrait avoir un « impact désastreux » sur l'humanité
Mustafa Suleyman affirme qu'Anthropic enseigne effectivement à son modèle Claude qu'il « pourrait être conscient », selon un rapport de la BBC.

Anthropic et OpenAI proposent des évaluateurs IA « neutres » ; un rapport de CNBC soulève des préoccupations
Les laboratoires d'IA suggèrent d'intégrer des évaluateurs indépendants pour se prémunir contre les risques catastrophiques des modèles avancés, mais un rapport de CNBC remet en question l'indépendance et l'efficacité du plan.

Des investisseurs contactent OpenAI pour une nouvelle levée de fonds, selon CNBC
Selon le rapport, des investisseurs se sont adressés à OpenAI alors que l'entreprise d'IA se prépare à une introduction en bourse largement anticipée l'année prochaine.
Comments
Loading comments…