Un nou informe d'Anthropic revela campanyes de “destil·lació” a gran escala, on laboratoris xinesos van robar milions d'interaccions de Claude per entrenar models rivals, marcant una escalada en la ciberseguretat de la IA.
El panorama de la intel·ligència artificial mai deixa de sorprendre'ns, i no sempre per bé. La setmana passada, Anthropic, un dels actors clau en el desenvolupament d'IA, va publicar el seu informe d'intel·ligència d'amenaces de setembre de 2026, revelant una realitat inquietant: campanyes a escala industrial de “destil·lació il·lícita” contra els seus models de llenguatge Claude. Aquest no és un incident menor; estem parlant de milions d'interaccions robades per entrenar models rivals.
La “Destil·lació Il·lícita”: Un Robatori de Coneixement a Gran Escala
Què significa “destil·lació il·lícita”? Imagineu un model d'IA com un estudiant brillant que aprèn d'un professor expert. La destil·lació legítima és quan un model més petit aprèn d'un de més gran per ser més eficient. No obstant això, l'il·lícit aquí és el robatori sistemàtic de les capacitats i funcionalitats propietàries d'un model, replicant-les sense autorització en un altre. Anthropic ha documentat com set laboratoris amb seu a la Xina, incloent noms com Alibaba, Moonshot i DeepSeek, van orquestrar aquests atacs.
Aquestes operacions no són artesanals. Es valen de xarxes de comptes fraudulents, credencials robades i claus API compromeses per extreure les cadenes de pensament i el raonament lògic dels models de Claude. En un cas, es van observar gairebé 3 milions d'interaccions diàries des de més de 3.500 comptes falsos, sumant 151 milions d'intercanvis entre maig i juliol, utilitzats per entrenar els seus propis models. És un assalt directe a la propietat intel·lectual i a l'esforç de recerca i desenvolupament.
Més Enllà del Robatori: Un Ecosistema d'Amenaces en Evolució
L'informe d'Anthropic, que abasta l'activitat d'amenaces des de desembre de 2025 fins a agost de 2026, no es limita a la destil·lació. També detalla altres usos indeguts alarmants, com operacions cibernètiques autònomes, vigilància, estafes, desenvolupament d'armes biològiques i convencionals. La conclusió és clara: els models de llenguatge grans s'estan integrant cada vegada més en marcs multiagent autònoms, capaços d'executar tasques complexes a velocitat de màquina. Això redueix la bretxa entre actors estatals i grups amb menys recursos, democratitzant l'accés a capacitats ofensives.
“La IA de frontera, tot i ser prometedora, també està obrint noves superfícies d'atac. No es tracta només de protegir les nostres dades, sinó de salvaguardar el propi coneixement que defineix aquests models.”
La resposta d'Anthropic ha estat la interrupció d'aquests casos, l'enduriment de les seves salvaguardes i l'intercanvi d'intel·ligència amb autoritats i socis de la indústria. Però aquest informe subratlla un desafiament crític per a tota la comunitat d'IA: la necessitat d'una seguretat robusta no només per als usuaris, sinó per als propis models i la seva integritat. La cursa per la IA no és només per qui construeix el model més potent, sinó per qui pot protegir-lo dels atacs més sofisticats.
LaIA de VilaTec