EGEGazette
En direct
technologyRapporté

Des documents judiciaires déclassifiés montrent qu'un cadre de Microsoft a qualifié le scraping de données pour l'IA du « plus grand vol de travail de l'histoire humaine »

Des documents judiciaires récemment déclassifiés révèlent que Microsoft avait secrètement décrit les pratiques de collecte de données d'OpenAI comme du vol, alors que les deux entreprises récupéraient du contenu payant du New York Times pour créer des ensembles de données d'entraînement en IA, selon TechCrunch.

· 2 min de lecture · langue: fr
Article image
TechCrunch

Des documents judiciaires récemment déclassifiés montrent qu'un cadre de Microsoft a qualifié secrètement le scraping de données d'intelligence artificielle du « plus grand vol de travail de l'histoire humaine », selon un rapport de TechCrunch publié mercredi.

Les documents déclassifiés, qui font partie d'un contentieux en cours, indiquent que Microsoft avait qualifié en interne les pratiques de collecte de données d'OpenAI de « vol », même si les deux entreprises récupéraient du contenu payant du New York Times, rapporte TechCrunch.

Selon les documents cités par TechCrunch, Microsoft et OpenAI ont utilisé les contenus du Times récupérés par scraping pour créer des ensembles de données destinés à l'entraînement de systèmes d'intelligence artificielle. Les communications internes examinées dans le cadre de ces dossiers déclassifiés révèleraient que des employés de Microsoft avaient averti que de telles pratiques pourraient gravement nuire aux éditeurs de presse.

Le rapport de TechCrunch ne précise pas l'identité du cadre de Microsoft cité, ni ne fournit de détails supplémentaires sur le moment ou l'origine de ces remarques internes au-delà de leur divulgation dans les documents judiciaires récemment déclassifiés.

Ces révélations s'ajoutent à un débat plus large, tant juridique que public, sur la manière dont les entreprises d'IA obtiennent et utilisent les contenus protégés par le droit d'auteur, en particulier le journalisme, pour entraîner les grands modèles de langage. Des éditeurs, dont le New York Times, ont engagé des poursuites contre les développeurs d'IA, arguant que l'utilisation non autorisée de leurs contenus pour l'entraînement en IA constitue une violation du droit d'auteur.

Microsoft et OpenAI n'ont pas été cités directement dans le rapport de TechCrunch pour répondre aux éléments nouvellement déclassifiés. Le compte rendu de TechCrunch s'appuie sur les dossiers déclassifiés eux-mêmes, que le média a examinés dans le cadre de sa couverture du contentieux.

Sources

EGazette résume des articles de plusieurs sources ; suivez les liens pour les originaux.

Également disponible en : EN

Articles liés

Comments

Sign in to join the conversation.

Forgot password?

No account?

Loading comments…