L'entraînement des IA sur des livres protégés par copyright reste juridiquement incertain
- 01L'entraînement des IA sur des livres protégés par copyright est juridiquement incertain, car le droit d'auteur ne sanctionne pas explicitement l'usage des œuvres à cette fin.
- 02Un tribunal a jugé licite l'entraînement d'un modèle d'IA sur des livres protégés, mais a condamné une entreprise pour avoir obtenu ces livres illégalement.
- 03Le cadre juridique actuel, datant de 1976, ne couvre pas explicitement l'entraînement des IA, laissant les auteurs sans protection claire.

L'entraînement des modèles d'IA sur des œuvres protégées par le droit d'auteur, comme des livres, s'inscrit dans un cadre légal flou et contesté. Les auteurs, dont les textes sont utilisés sans leur consentement ni connaissance préalable, voient leurs droits potentiellement bafoués, tandis que les entreprises développant ces modèles invoquent des interprétations juridiques favorables à leur pratique.
La légalité de cette méthode repose sur une distinction centrale : le droit d'auteur sanctionne le copiage d'une œuvre, mais pas nécessairement son usage ou sa consommation. Un tribunal américain a récemment statué que l'entraînement d'un modèle d'IA sur des livres protégés était licite, car il s'agirait d'un processus comparable à la lecture ou à l'étude d'une œuvre, et non à sa reproduction. Cependant, cette décision a été assortie d'une amende de 1,5 milliard de dollars à l'encontre d'une entreprise pour avoir obtenu ces livres via des bibliothèques en ligne illégales, et non pour l'acte d'entraînement lui-même. Cette nuance souligne l'ambiguïté persistante : la légalité dépend moins de l'usage des données que de leur source.
Le cadre juridique actuel, inchangé depuis 1976, ne prévoit pas explicitement de disposition applicable à l'entraînement des IA. Les juges doivent donc interpréter des textes anciens à l'aune de technologies récentes, ce qui génère des divergences d'interprétation. Certains estiment que cette situation avantage les acteurs de l'IA, tandis que d'autres y voient une faille exploitable. Le manque de clarté expose les auteurs à des risques de contournement de leurs droits, sans garantie de compensation ou de contrôle sur l'utilisation de leurs œuvres.
Articles liés

Sony Music et Warner Chappell attaquent Anthropic pour violation de droits d'auteur
Les majors musicales attaquent Anthropic pour l'utilisation présumée de leurs œuvres protégées dans les entraînements de modèles d'IA.

Gemini Notebook permet d'interagir avec les livres achetés sur Google Play Books
Gemini Notebook permet désormais d'extraire et d'interagir avec le contenu des livres achetés sur Google Play Books.

Micro1 dépasse 500 M$ de chiffre d'affaires annuel dans les données d'IA
Décryptage de la croissance fulgurante d'une startup spécialisée dans les données pour l'entraînement des modèles d'IA.