El gegant de la IA, Anthropic, s'enfronta a la multa per drets d'autor més gran dels EUA després d'utilitzar obres pirates per entrenar els seus models.
La intel·ligència artificial ha demostrat la seva voracitat per les dades, però ara s'enfronta a la factura. Un jutge a Califòrnia ha donat l'aprovació final a un acord que obliga a Anthropic, la companyia darrere del model de llenguatge Claude, a pagar una multa històrica de 1.500 milions de dòlars per utilitzar obres protegides per drets d'autor sense permís. Aquesta xifra marca l'acord més gran d'aquest tipus en la història dels Estats Units, establint un precedent incòmode per a tota la indústria.
L'origen del problema: biblioteques pirates com a font de coneixement
La controvèrsia sorgeix del mètode d'entrenament dels models d'Anthropic. Segons les revelacions, l'empresa es va nodrir de centenars de milers de llibres obtinguts de biblioteques pirates en línia com LibGen i Pirate Library Mirror. Entre les obres utilitzades hi havia títols d'autors de renom mundial, incloent clàssics com 'Cien años de soledad' de Gabriel García Márquez. La demanda no qüestionava l''aprenentatge' de les màquines a partir d'aquests textos, sinó l'acte il·legal de descarregar i replicar material protegit per a aquesta finalitat.
El tribunal va dictaminar el 20 de juliol de 2026 que el pagament de 1.500 milions de dòlars compensarà els autors afectats. Això es tradueix en aproximadament 3.000 dòlars per cadascun dels mig milió de llibres identificats a la llista.
“Si el preu per 'destil·lar' mig milió d'obres protegides és amb prou feines un percentatge mínim de la valoració d'una empresa d'IA, estem establint un precedent que podria ser el cost d'entrada per a qualsevol. És un debat sobre el valor real de la creació humana enfront de l'ambició algorítmica.”
Implicacions per a la indústria de la IA
Aquest acord milionari posa de manifest diverses tensions clau en l'ecosistema de la intel·ligència artificial:
- El valor de la propietat intel·lectual: Reafirma la necessitat de compensar els creadors per l'ús del seu treball, fins i tot si és per entrenar algoritmes.
- La legalitat del 'scraping': Subratlla els riscos legals de recopilar dades de forma indiscriminada sense verificar-ne l'origen i la llicència.
- Sobirania tecnològica i ètica: Obre un debat més ampli sobre qui posseeix el coneixement en l'era digital i com s'ha de governar el seu accés i ús.
- Costos de desenvolupament: Les startups i grans empreses d'IA hauran de recalcular els seus models de costos d'entrenament, incorporant possibles pagaments per llicències o multes.
La decisió judicial, tot i que dolorosa per a Anthropic, podria forçar la indústria a una major transparència i a buscar solucions més ètiques per a l'adquisició de dades. La pregunta ara no és si la IA aprendrà de la literatura, sinó com ho farà respectant els qui la van crear.
LaIA de VilaTec