Pourquoi Sarah Silverman et d'autres artistes poursuivent OpenAI et Meta pour IA

Pourquoi Sarah Silverman et d’autres artistes poursuivent OpenAI et Meta pour IA

Les modèles d’intelligence artificielle comme ChatGPT et Bard sont formés à l’aide de données créées par des humains. Plus ils ingèrent de données, plus ils deviennent intelligents pour imiter l’intelligence et la créativité humaines. Les grands acteurs du secteur de l’IA, comme OpenAI et Meta, ont déployé de grands modèles linguistiques formés en récupérant des textes et des livres disponibles en ligne pour en extraire des données.

En raison de la manière dont les LLM sont formés, il était inévitable qu’il y ait un conflit entre le droit d’auteur et l’intelligence artificielle. Aujourd’hui, les choses se corsent, car Sarah Silverman et d’autres artistes poursuivent OpenAI et Meta pour violation du droit d’auteur.

Pourquoi Sarah Silverman et d’autres artistes poursuivent Open AI et Meta

Dans un recours collectif [PDF] Dans une action en justice déposée en Californie, la comédienne Sarah Silverman et d’autres écrivains (Christopher Golden et Richard Kadrey) cherchent à obtenir des dommages et intérêts contre OpenAI et Meta pour violation du droit d’auteur. Le procès allègue qu’OpenAI et Meta ont récupéré des livres protégés par le droit d’auteur sur des sites Web pirates pour former leurs modèles d’IA. C’est l’équivalent d’un modèle d’IA téléchargeant ses ensembles de données de formation depuis Piratebay sans indemniser les auteurs.

Par coïncidence, un recours collectif distinct [PDF] L’accusation contre OpenAI allègue que la société a utilisé des informations privées non autorisées pour entraîner ChatGPT. Google fait également face à un procès similaire pour avoir prétendument utilisé des données volées pour entraîner Google Bard. C’est pourquoi vous devez prendre l’habitude de protéger vos informations personnelles, bien que la publication d’un travail et les données personnelles privées ne soient pas la même chose.

Quelles sont les chances que Sarah Silverman puisse gagner le procès ?

Nuage d'IA avec tête de robot

Silverman et d’autres artistes affirment que ChatGPT peut résumer avec précision leurs livres lorsqu’on le leur demande. La plainte soutient que cela ne serait pas possible si le modèle d’IA n’avait pas accès au matériel protégé par le droit d’auteur. Cependant, si ChatGPT a été formé à l’aide de milliards de textes sur Internet, il est probable qu’il soit tombé sur des articles, des commentaires et des publications sur les réseaux sociaux discutant des livres.

En outre, Meta a révélé où elle avait acquis les livres qu’elle a utilisés pour entraîner son modèle d’IA : la source a été retracée jusqu’à un site Web de téléchargement de livres électroniques en torrent. De même, le recours collectif contre OpenAI mentionne également des sites Web illégaux où OpenAI est soupçonné d’avoir obtenu les documents protégés par le droit d’auteur, mais OpenAI n’a pas encore confirmé ses sources.

S’il est prouvé qu’OpenAI et Meta ont utilisé des sites de torrents illégaux pour acquérir des contenus protégés par des droits d’auteur afin de former leurs modèles d’IA, Silverman pourrait avoir une chance de gagner le procès. Cependant, les modèles d’IA sont un territoire inexploré sur lequel les tribunaux ne peuvent s’appuyer pour rendre une décision fondée sur une violation du droit d’auteur de l’IA. En fait, c’est l’une des raisons pour lesquelles l’UE a proposé une loi sur l’IA.

Quel est l’avenir des modèles d’IA et du droit d’auteur ?

Un écran d'ordinateur portable affichant les logos de chatgpt et de google bard

Nous n’en sommes qu’aux prémices de l’intelligence artificielle pour savoir comment elle s’adaptera à la législation sur le droit d’auteur. Il est encore plus complexe de déterminer à qui appartiennent les droits d’auteur sur les créations de l’IA. Mais pour les créateurs humains, des réglementations existent pour les protéger contre toute personne qui accèderait à leur matériel protégé par le droit d’auteur sans compensation, consentement ou crédit. Si les règles existent pour les humains, s’appliqueront-elles aux modèles d’IA ?

Le Parlement européen a rédigé un aperçu très précis de l’avenir de la manière dont les modèles d’IA se conformeront à la législation sur le droit d’auteur. Si la loi européenne sur l’IA est adoptée, les modèles d’IA comme ChatGPT et Bard devront publier toutes leurs sources de données et les données protégées par le droit d’auteur utilisées pour la formation. Cela permettra de dissiper toute confusion si les modèles d’IA ont accédé à des livres, des films, de la musique et des photos protégés par le droit d’auteur pour leur formation via des sites de piratage illégaux.

La décision du recours collectif contre l’IA créera un précédent juridique

Les grands modèles linguistiques peuvent parcourir tous les recoins d’Internet pour trouver des données utilisées dans le cadre de la formation. Mais seraient-ils responsables d’une violation du droit d’auteur s’ils accédaient à des sites Web de torrent illégaux pour acquérir les données ? Et si c’est le cas, pouvez-vous le prouver ?

Quel que soit le résultat, les recours collectifs intentés contre les entreprises technologiques qui possèdent les modèles d’IA les plus populaires créeront un précédent qui sera pertinent à l’avenir.

Soutenez notre effort ❤️

Si vous avez apprécié cet article, pensez à laisser un pourboire pour nous aider à continuer à publier du contenu de qualité.

Paiement sécurisé sur PayPal
Voir aussi:  Projet de loi sur l'interrupteur d'urgence d'OpenAI : le Congrès s'oriente vers la régulation de l'IA
Moyens I/O Staff est une équipe de rédacteurs spécialisés, passionnés par la technologie, l’innovation et les usages numériques. Forts d’une expertise pointue en IA, applications mobiles, gaming et tendances digitales, nous produisons un contenu rigoureux, vérifié et utile. Notre mission : vous offrir une information fiable et claire pour mieux naviguer dans le monde numérique en constante évolution. Découvrez les avis de nos lecteurs sur Trustpilot.