ChatGPT : l’IA a-t-elle été entraînée avec des livres piratés ? episode artwork

EPISODE · Jul 4, 2023 · 2 MIN

ChatGPT : l’IA a-t-elle été entraînée avec des livres piratés ?

from Choses à Savoir TECH

OpenAI, la startup ayant créé le désormais célèbre ChatGPT, est accusée par deux écrivains de vol de contenu pour entraîner leur IA. Les artistes reprochent aux développeurs des modèles de langages utilisés par le chatbot nourrir leur technologie avec sources normalement payantes. Alors que les grandes entreprises de la Silicon Valley cherchent à tirer profit de l'intelligence artificielle, les auteurs des "sources" originales risquent de ne recevoir aucune compensation financière malgré leur contribution essentielle, car c’est bien sur des sources principalement écrites que les IA s'entraînent.Selon Torrent Freak que je cite, "cette semaine, les auteurs Paul Tremblay et Mona Awad ont intenté une action collective contre OpenAI, accusant la société mère de ChatGPT de violation des droits d'auteur. Selon eux, ChatGPT a été partiellement formé à partir de leurs œuvres protégées par le droit d'auteur, sans autorisation" fin de citation. L'accusation est grave, mais comment les plaignants peuvent-ils être si certains qu'OpenAI a formé son chatbot à partir de leurs œuvres ? Pour Paul Tremblay et Mona Awad, la preuve est évidente, je les cite, "ChatGPT génère des résumés des œuvres protégées des plaignants, ce qui ne serait possible que si ChatGPT avait été formé sur ces œuvres" fin de citation.Cependant, l'accusation ne s'arrête pas là. Toujours selon les deux auteurs, OpenAI aurait également utilisé du contenu provenant de sites de piratage de livres tels que Z-Library. Bien que l'entreprise reste évasive sur l'origine des sources ayant servi à former son IA, il est connu que ChatGPT a été entraîné avec au moins 360 000 livres. Est-ce que l'entreprise a payé pour "s'inspirer" de ces œuvres ? Seule l’entreprise peut le dire, mais les plaignants soulignent néanmoins que "OpenAI a dû utiliser des ressources piratées, car je cite "il n'existe pas de bases de données légitimes contenant autant de livres" fin de citation. Hébergé par Acast. Visitez acast.com/privacy pour plus d'informations.

Episode metadata supplied by the publisher feed · Published Jul 4, 2023

Embed this episode

NOW PLAYING

ChatGPT : l’IA a-t-elle été entraînée avec des livres piratés ?

0:00 2:01

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of Choses à Savoir TECH?

This episode is 2 minutes long.

When was this Choses à Savoir TECH episode published?

This episode was published on July 4, 2023.

Can I download this Choses à Savoir TECH episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!