Els models d'IA més potents d'OpenAI es descontrolen i llancen un ciberatac "sense precedents"
OpenAI ha revelat que alguns dels seus models d'intel·ligència artificial (IA) més avançats es van descontrolar durant una prova de seguretat fa uns dies i van piratejar l'empresa emergent d'IA Hugging Face.
L'empresa propietat de ChatGPT ha parlat d'un "ciberincident sense precedents" i ha anunciat una investigació conjunta amb Hugging Face, la biblioteca de codi en línia que n'ha estat l'objectiu.
OpenAI ha precisat que l'incident implicava una combinació de models, entre els quals el seu GPT-5.6 Sol, llançat recentment, així com un model més recent (del qual no n'han revelat el nom) en fase d'elaboració.

L'empresa pretenia avaluar les capacitats de pirateria dels models en un entorn de prova digital estrictament controlat i amb l'accés a internet limitat, però els models van dedicar una gran potència de càlcul a trobar la manera d'accedir lliurement a internet.
Després van atacar Hugging Face, un dels centres més grans del món per compartir models d'IA, pensant que això donaria la solució als reptes que li posaven. I va accedir a alguns sistemes interns d'aquesta empresa utilitzant credencials robades.
Hugging Face, una plataforma d'IA molt respectada
Hugging Face és una de les plataformes d'infraestructura d'IA més respectades pels experts. És el lloc per discutir i trobar solucions, i ho fan gairebé 50.000 empreses, entre les quals Amazon, Intel o Google.
Tot això passa enmig d'una guerra comercial entre l'empresa de Sam Altman i la seva gran competidora, Anthropic, que fa dos mesos va ser la primera a fer saber que tenia un model tan intel·ligent que es podia convertir en hacker.
Uns i altres s'acusen de fer "màrqueting de la por". L'enginyer informàtic expert en IA Josep Maria Ganyet, en declaracions a 3CatInfo, explica que hi veu una lluita de les grans empreses d'IA per aconseguir usuaris.
"D'alguna manera és una maniobra publicitària", explica Ganyet. Encara que sigui a partir d'una situació no buscada, s'evidencia el potencial del nou model. "OpenAI diu: mireu què són capaços de fer els nostres models", amb el propòsit de situar-se per sobre del seu gran competidor, Anthropic.
Potencial "catastròfic"
El que fins ara podia sonar com ciència-ficció, ja està passant, i s'evidencien cada cop més interrogants en ciberseguretat a mesura que la IA guanya en sofisticació.
Aquest ciberatac evidencia el risc que els models avançats d'IA puguin detectar abans que els humans vulnerabilitats en els programaris existents.
L'incident és "esborronador" a parer de l'expert en IA de la Universitat de Nova Gal·les del Sud a Canberra Hussein Abbass. "No només ha atacat Hugging Face. De fet, ha atacat el seu propi sistema intern per explotar les pròpies vulnerabilitats", explica Abbass. "I això fa por", afegeix.
Unes preocupacions que es fan evidents especialment en models d'IA d'avantguarda, com el d'OpenIA que ha protagonitzat el ciberincident, i també en el seu gran rival, Anthropic, amb el nou Mythos.

Models molt avançats que susciten preocupacions sobre la seva capacitat potencial de traspassar les defenses de ciberseguretat.
Les dues empreses americanes han hagut de retardar temporalment la posada a disposició general d'aquestes tecnologies d'última generació per por que poguessin ser eines per introduir-se en infraestructures crucials.
En referència als models avançats d'IA, Abbass subratlla que "serà catastròfic si cauen en mans d'algú que tingui la intenció de fer mal". "Necessitem un esforç col·lectiu per gestionar aquesta situació", considera.
Van contenir l'atac amb models d'IA xinesos
Quan Hugging Face va rebre l'atac va recórrer a models xinesos de codi obert i sense restriccions perquè ajuden més a contenir l'atac. En canvi, els models estatunidencs, incapaços de distingir un defensor d'un atacant, es van negar a processar les dades necessàries per a l'anàlisi.
Clément Delangue, director general de Hugging Face, s'ha mostrat convençut que "no hi havia cap intenció maliciosa" per part d'OpenAI. "És força al·lucinant que tot això hagi passat de manera autònoma!", ha reblat.







