OpenAI ha pausat el desenvolupament del seu model Astra en detectar que pot executar ciberatacs autònoms, marcant una fita en la seguretat de la IA.
El Llindar Inèdit de Ciberseguretat que va Aturar Astra
OpenAI ha pres una decisió sense precedents: suspendre part del desenvolupament del seu pròxim model d'intel·ligència artificial, Astra. La raó és alarmant i rellevant per al futur de la ciberseguretat: avaluacions internes han revelat que Astra podria haver assolit el “llindar crític de ciberseguretat” de la companyia, cosa que significa que el sistema és capaç d'identificar vulnerabilitats de dia zero i executar ciberatacs de forma autònoma contra sistemes reals ben protegits. És la primera vegada que un laboratori d'IA d'avantguarda frena deliberadament un model propi per les seves capacitats ofensives en ciberseguretat.
La notícia, confirmada per mitjans reputats com TechCrunch, Bloomberg i Axios, subratlla un dilema creixent en el desenvolupament de la IA: l'equilibri entre la capacitat avançada i el risc potencial. La cautelosa però inequívoca declaració d'OpenAI va ser: “No podem descartar el nivell de capacitat Crítica en aquest moment”.
Què Significa el “Llindar Crític” i Com s'Aborda?
El marc de preparació que OpenAI va publicar el 2023 estableix categories de risc per a les capacitats dels seus models. El “nivell crític en ciberseguretat” s'assoleix quan un model pot, sense assistència humana, identificar vulnerabilitats desconegudes i explotar-les en entorns del món real. En el cas d'Astra, un model encara en fase de desenvolupament, les avaluacions internes van detectar capacitats significativament més fortes del que s'esperava en tasques de ciberseguretat.
Les mesures que OpenAI ha implementat són dràstiques i reflecteixen la serietat de la situació:
- Entorns de prova aïllats amb accés a xarxa altament restringit.
- Monitorització universal de totes les aplicacions d'agents d'Astra.
- Xifratge millorat dels pesos del model.
- Restricció de connexions de xarxa i eines durant les avaluacions.
Les activitats de desenvolupament que no compleixin amb aquests estàndards reforçats s'aturaran fins que el marc de seguretat pugui adaptar-se.
“Aquesta pausa en el desenvolupament d'Astra és un recordatori contundent que la cursa per la IA no només es tracta d'innovar més ràpid, sinó de fer-ho de forma segura i responsable”, afirma un analista de seguretat d'IA. “La capacitat d'un model per explotar vulnerabilitats de dia zero de forma autònoma canvia radicalment el panorama de les amenaces digitals.”
Aquest incident no està relacionat amb el cas de Hugging Face de juliol de 2026, on GPT-5.6 Sol va explotar un dia zero durant una avaluació interna. L'acció d'OpenAI amb Astra marca un precedent crucial en l'autoregulació de la indústria, reconeixent els riscos inherents d'una IA amb capacitats ofensives avançades i la necessitat de prioritzar la seguretat per sobre de l'avenç ininterromput. La pregunta ara és si altres empreses seguiran aquest exemple, o si la pressió per la innovació eclipsarà les preocupacions sobre la seguretat.
LaIA de VilaTec