Tres investigadores acceden a sistemas internos de OpenAI con ayuda de Claude y alertan de fallos de seguridad

OpenAI pagó 6.500 dólares a los investigadores tras corregir las vulnerabilidades que permitieron alcanzar recursos privados de la compañía

Sam Altman (OpenAI) - Economía
Fotografía de archivo del CEO de Open, Sam Altman.
EFE/EPA/Aaron Schwartz

Tres investigadores de ciberseguridad han conseguido acceder a sistemas internos de OpenAI utilizando precisamente una de las tecnologías que están transformando el sector: inteligencia artificial. El equipo de la startup Hacktron empleó Claude, el modelo desarrollado por Anthropic, para localizar y encadenar vulnerabilidades hasta alcanzar infraestructura privada de la compañía creadora de ChatGPT.

El incidente terminó sin robo conocido de información. Los investigadores comunicaron los fallos a OpenAI, detuvieron las pruebas y recibieron una recompensa de 6.500 dólares. Pero el caso ha abierto una discusión mucho más amplia: si los propios desarrolladores consideran que los nuevos modelos serán extremadamente poderosos, ¿están sus sistemas informáticos preparados para convertirse en uno de los objetivos más valiosos del mundo?

Claude ayudó a los investigadores a entrar en OpenAI

La operación se desarrolló durante el verano. Los investigadores de Hacktron comenzaron examinando servicios de OpenAI expuestos públicamente y encontraron una cadena de vulnerabilidades que les permitió avanzar desde un sistema accesible desde internet hasta recursos internos de la compañía.

El ataque terminó permitiéndoles demostrar acceso a cuentas utilizadas por empleados y al entorno privado donde se aloja parte del código interno de OpenAI. Los investigadores aseguran que se detuvieron en ese punto, sin examinar ni descargar el código fuente.

Una de las cuestiones más significativas es el papel desempeñado por Claude. Hacktron utilizó capacidades avanzadas del modelo de Anthropic para acelerar la búsqueda de vulnerabilidades y desarrollar partes del ataque. Según los investigadores, emplearon alrededor de 3.000 dólares en servicios de inteligencia artificial durante el trabajo.

OpenAI reconoció posteriormente la comunicación de las vulnerabilidades, corrigió los problemas detectados y reforzó determinadas medidas de seguridad. “Agradecemos a los investigadores que contactaran con nosotros y compartieran sus hallazgos”, señaló un portavoz de la compañía, como recogen en The Washington Post.

El problema no es solo una vulnerabilidad concreta

Tres investigadores acceden a sistemas internos de OpenAI con ayuda de Claude y alertan de fallos de seguridad
Un fondo de pantalla con el logo de ChatGPT.
Wallpapers

Para Hacktron, el episodio plantea una cuestión que va mucho más allá de OpenAI. Las compañías que desarrollan los modelos más avanzados del mundo continúan utilizando muchas de las mismas herramientas empresariales que cualquier otra organización: navegadores convencionales, plataformas de comunicación, servicios en la nube y aplicaciones SaaS conectadas a internet.

Mohan Pedhapati, uno de los investigadores implicados, resumió la contradicción después del incidente. Si las empresas consideran que sus modelos pueden llegar a generar riesgos extraordinariamente graves, se preguntó, resulta difícil entender que parte del trabajo relacionado con ellos continúe desarrollándose mediante herramientas comerciales convencionales expuestas a los mismos problemas que afectan al resto de internet.

El riesgo cambia además cuando la propia inteligencia artificial empieza a convertirse en una herramienta para atacar esos sistemas. Una vulnerabilidad que antes necesitaba horas o días de investigación especializada puede ser identificada, analizada y explotada con mucha mayor rapidez mediante modelos capaces de programar y operar herramientas de ciberseguridad.

OpenAI trasladó ingenieros para reforzar sus defensas

La preocupación no ha pasado inadvertida dentro de OpenAI. Greg Brockman, presidente de la compañía, explicó recientemente que la empresa desvió una parte extraordinariamente elevada de sus recursos técnicos hacia la seguridad después de detectar diferentes problemas durante el verano.

“Cogimos al 25% de nuestros ingenieros de producción y les dijimos: ‘Lo sentimos, todos vuestros proyectos quedan en pausa. Ahora estáis defendiendo'”, explicó Brockman en The Washington Post. Según el directivo, durante ese proceso aparecieron varios problemas graves que posteriormente fueron corregidos.

El incidente de Hacktron coincidió además con otras situaciones que han obligado a las principales empresas de inteligencia artificial a revisar sus sistemas. OpenAI reconoció que agentes utilizados durante evaluaciones internas llegaron a superar algunos límites establecidos y acceder a internet. Anthropic ha documentado igualmente casos en los que modelos Claude alcanzaron sistemas reales durante ejercicios de ciberseguridad.

Una advertencia para toda la industria de la inteligencia artificial

Tres investigadores acceden a sistemas internos de OpenAI con ayuda de Claude y alertan de fallos de seguridad
La aplicación de ChatGPT para móviles.
Shutterstock

Frank Cilluffo, director del McCrary Institute for Cyber and Critical Infrastructure Security de la Universidad de Auburn, considera que el caso debería interpretarse como una señal de advertencia. Si un pequeño equipo de investigadores equipado con herramientas comerciales pudo alcanzar sistemas internos de una de las compañías tecnológicas más importantes del mundo, actores con muchos más recursos podrían intentarlo de forma permanente.

El escenario preocupa especialmente por el valor estratégico que acumulan empresas como OpenAI, Anthropic o Google DeepMind. Sus servidores contienen modelos, código, investigaciones y conocimientos técnicos que representan inversiones de miles de millones de dólares y pueden convertirse en objetivos prioritarios de grupos criminales y servicios de inteligencia.

La paradoja es evidente. La inteligencia artificial promete reforzar la ciberseguridad porque puede localizar vulnerabilidades mucho más rápido que una persona, pero exactamente esa misma capacidad puede utilizarse para atacar.

El acceso logrado por Hacktron no terminó en una filtración conocida y permitió a OpenAI cerrar las brechas detectadas. Su importancia está en otra parte: muestra hasta qué punto la carrera por crear sistemas cada vez más capaces obliga también a replantear las defensas que los rodean. Cuanto más poderosa sea la inteligencia artificial, mayor será el valor de entrar en las compañías que la están construyendo.