Skip to main content Scroll Top
19th Ave New York, NY 95822, USA

Investigadores usan Claude de Anthropic para hackear OpenAI y acceder a cuentas de ChatGPT

Investigadores de la empresa de seguridad Hacktron AI accedieron a cuentas de ChatGPT de empleados de OpenAI durante un ejercicio autorizado para detectar vulnerabilidades. El equipo encontró una falla en el foro público de ayuda de la compañía, administrado mediante Discourse, y utilizó los modelos Claude Opus 4.8 y Claude Opus 5, de Anthropic, para desarrollar un ataque funcional.

OpenAI confirmó el incidente y señaló que la vulnerabilidad fue corregida aproximadamente 14 horas después de recibir el aviso. La empresa también entregó a los investigadores una recompensa de 6 mil 500 dólares por reportar el hallazgo.

La falla estaba en el foro de ayuda de OpenAI

De acuerdo con Hacktron, la vulnerabilidad permitió tomar el control del sitio de soporte público. Los investigadores informaron de inmediato el problema a OpenAI y a Discourse, y colaboraron con ambas compañías para coordinar la solución.

El acceso a través del foro permitió llegar a cuentas de empleados de OpenAI vinculadas con los servicios de la compañía. La prueba se realizó dentro de un programa autorizado de búsqueda de fallas, por lo que los investigadores comunicaron sus hallazgos en lugar de utilizar el acceso con fines maliciosos.

Claude Opus 5 logró un ataque funcional

Hacktron explicó que inicialmente empleó Claude Opus 4.8 para identificar y explotar el problema, pero el modelo tuvo dificultades para producir un resultado consistente. Posteriormente, el equipo recurrió a Claude Opus 5, que, según los investigadores, consiguió desarrollar un ataque funcional en aproximadamente tres horas.

Los investigadores indicaron que no utilizaron Claude Mythos, otro modelo de Anthropic con capacidades avanzadas de ciberseguridad y acceso restringido a un grupo reducido de organizaciones especializadas.

Crece la preocupación por el uso de IA en ciberataques

El caso ocurre en medio de una preocupación creciente entre especialistas en seguridad informática por la capacidad de las herramientas de inteligencia artificial para acelerar el desarrollo de ataques sofisticados. Procesos que antes podían requerir equipos especializados y meses de trabajo ahora pueden avanzar con mayor rapidez cuando se utilizan modelos capaces de generar y probar código.

Hacktron informó que continúa realizando pruebas similares en otras compañías. El incidente también pone de relieve la importancia de corregir con rapidez las vulnerabilidades en servicios de terceros y de revisar las conexiones entre plataformas públicas, cuentas corporativas y sistemas internos.