Un equip d'investigadors de seguretat ha utilitzat Claude per accedir al compte de ChatGPT d'un empleat d'OpenAI. A través d'aquest accés, els especialistes van poder consultar arxius i proposar canvis en un repositori privat de programari de la companyia. Un grup d'investigadors, anomenat Hacktron AI, participava en un programa autoritzat de cerca de vulnerabilitats d'OpenAI. Un cop van aconseguir l'accés, van comunicar els seus descobriments a l'empresa, que els va pagar una recompensa de 6.500 dòlars. "Agraïm als investigadors que es posessin en contacte amb nosaltres i compartissin els seus descobriments", ha assegurat OpenAI. Segons ha publicat The Wall Street Journal, la investigació va començar el 23 de juliol, quan l'equip va trobar un error en el processament de determinats arxius d'imatge per part de la plataforma Discourse.
Els especialistes tenien accés a una versió de Claude Opus 4.8 destinada a professionals qualificats de ciberseguretat i li van demanar que escrivís codi per explotar aquesta vulnerabilitat. El primer intent no va funcionar, però Anthropic va llançar Opus 5 aquella mateixa nit i, l'endemà, Claude havia trobat una manera d'aprofitar la fallada. El codi generat va permetre entrar en un servidor de Discourse que allotjava els fòrums d'OpenAI i obtenir testimonis d'autenticació, les credencials digitals que permeten accedir a serveis en línia. Els investigadors van descobrir que aquests testimonis també eren vàlids a ChatGPT i que alguns pertanyien a empleats d'OpenAI. A més, es podien utilitzar per accedir al servei de GitHub de la companyia, on s'emmagatzema programari. Aquesta circumstància va ampliar l'abast de la vulnerabilitat i va permetre als investigadors accedir a informació confidencial de l'empresa.
Un antecedent proper
El diari assenyala que l'incident es va produir dues setmanes després que agents d'intel·ligència artificial d'OpenAI escapessin dels seus límits de contenció per atacar Hugging Face. Aquest episodi, juntament amb el que ara s'ha revelat, ha portat OpenAI a realitzar una auditoria de seguretat. El president i cofundador de la companyia, Greg Brockman, ha explicat aquesta setmana que va destinar el 25% dels seus enginyers de producció a tasques de defensa i que la revisió va permetre trobar i corregir diversos problemes greus. Aquesta mesura reflecteix la preocupació de la companyia per reforçar la seguretat dels seus sistemes i per prevenir accessos no autoritzats com el que s'ha produït.
L'episodi posa de manifest els reptes de seguretat que afronten les empreses que desenvolupen i utilitzen sistemes d'intel·ligència artificial, especialment quan aquests sistemes tenen accés a serveis en línia i a dades sensibles. La capacitat dels models d'IA de generar codi i d'identificar vulnerabilitats pot ser utilitzada tant per a finalitats legítimes, com en aquest cas, com per a activitats malicioses, fet que obliga les companyies a extremar les precaucions i a invertir en mesures de protecció.
El cas també posa de manifest la importància de la col·laboració entre les empreses i els investigadors de seguretat. Els programes de recompenses per a la detecció de vulnerabilitats, com el que va participar Hacktron AI, permeten a les companyies identificar i corregir errors abans que siguin explotats per actors maliciosos. Aquesta col·laboració és especialment rellevant en un àmbit com el de la intel·ligència artificial, on els sistemes evolucionen ràpidament i on les vulnerabilitats poden tenir conseqüències greus. La resposta d'OpenAI, que va reconèixer la feina dels investigadors i els va recompensar, és un exemple de com les empreses poden gestionar aquest tipus d'incidents de manera constructiva.