Sony Music Publishing et Warner Chappell Music ont déposé leur plainte le 28 août devant le tribunal fédéral du Northern District of California. Trente-cinq sociétés d'édition ou entités affiliées apparaissent parmi les plaignants.
Anthropic n'est pas seul sur la ligne des défendeurs. Son CEO et cofondateur Dario Amodei ainsi que le cofondateur Benjamin Mann sont également nommés personnellement dans la procédure.
Les éditeurs parlent de dizaines de milliers de compositions
Le cœur de l'accusation dépasse largement quelques réponses maladroites de Claude. Sony et Warner affirment qu'Anthropic a copié des dizaines de milliers de compositions protégées afin de construire et d'améliorer ses modèles.
Parmi les œuvres citées dans les différents documents et comptes rendus figurent des chansons associées à des artistes aussi différents que Mariah Carey, Taylor Swift, Michael Jackson ou encore des catalogues historiques comprenant Ain't No Mountain High Enough et Eye of the Tiger.
Les plaignants soutiennent qu'Anthropic a utilisé plusieurs méthodes : scraping, téléchargement automatisé et récupération de fichiers provenant de torrents ou d'autres sources qu'ils qualifient de pirates.
Le procès ne porte pas seulement sur ce que Claude récite
Les éditeurs reprochent aussi au modèle d'avoir parfois reproduit des paroles protégées de manière très proche, voire verbatim selon la plainte, lorsqu'un utilisateur lui demandait certaines chansons.
Mais ce n'est qu'une partie du dossier. Sony Music Publishing et Warner Chappell contestent directement la manière dont les données auraient été acquises avant même l'entraînement.
C'est une distinction assez importante. Le débat juridique autour de l'IA s'est souvent concentré sur la question du fair use appliqué à l'apprentissage. Une œuvre récupérée illégalement avant cet apprentissage ajoute un problème différent au dossier.
150 000 dollars par œuvre peuvent très vite devenir quelques milliards
En droit américain, les plaignants réclament notamment jusqu'à 150 000 dollars de dommages statutaires pour chaque œuvre dont la violation serait reconnue comme volontaire.
Ils demandent également des dommages pouvant atteindre 25 000 dollars pour certaines suppressions présumées d'informations de gestion du droit d'auteur.
Aucun tribunal n'a évidemment décidé qu'Anthropic devait payer ces montants. Leur multiplication par des dizaines de milliers de compositions explique néanmoins pourquoi la procédure est déjà décrite comme potentiellement multimilliardaire.
Toutes les majors de l'édition sont désormais en conflit judiciaire avec Anthropic
Sony et Warner ne sont pas les premiers. Universal Music Publishing Group, Concord et ABKCO ont déjà engagé une procédure contre Anthropic autour des paroles de chansons.
L'arrivée de Sony Music Publishing et Warner Chappell signifie désormais que les branches d'édition des trois grandes majors mondiales ont toutes un contentieux avec l'entreprise derrière Claude.
Le front commun est assez remarquable à un moment où l'industrie musicale adopte pourtant des stratégies très différentes avec les générateurs de musique. Warner Music a, par exemple, transformé certains de ses conflits avec Suno en accords de licence permettant le développement de nouveaux modèles avec du contenu autorisé.
Sony avait prévenu dès 2024
La position de Sony Music sur l'entraînement n'est pas nouvelle. En mai 2024, le groupe avait publiquement interdit, sauf autorisation explicite, l'utilisation de ses enregistrements, compositions, paroles, images et autres contenus pour le text and data mining ou l'entraînement de systèmes d'intelligence artificielle.
Le groupe expliquait déjà soutenir les usages créatifs de l'IA à condition que les artistes et auteurs conservent le contrôle sur leurs droits.
Deux ans plus tard, le principe est passé de la déclaration publique à la plainte fédérale.
Anthropic promet de se défendre
Anthropic conteste les accusations. L'entreprise a déclaré être en désaccord avec les affirmations des éditeurs et vouloir se défendre vigoureusement devant le tribunal.
Sa position s'inscrit dans une bataille beaucoup plus large sur le fair use. Les entreprises d'IA soutiennent généralement que l'entraînement transforme les œuvres en informations statistiques utilisées pour produire de nouveaux résultats, plutôt que pour distribuer des copies des originaux.
Les ayants droit répondent que cette théorie ne peut pas devenir une autorisation générale de constituer gratuitement des corpus commerciaux à partir de catalogues protégés.
Le prochain tube de l'industrie musicale pourrait bien se jouer devant un juge plutôt que sur Spotify.