Claude ayudó a hackear cuentas de ChatGPT: en menos de 72 horas llegaron a repositorios internos de OpenAI

Investigadores de ciberseguridad de inteligencia artificial (IA) revelaron que utilizaron Claude, el chatbot desarrollado por Anthropic, para comprometer cuentas de empleados de OpenAI vinculadas a ChatGPT y Codex, un ataque que finalmente les permitió demostrar que podían alcanzar repositorios internos de la empresa.
El hallazgo fue realizado por investigadores de Hacktron AI, quienes detallaron que toda la cadena, desde el descubrimiento inicial hasta conseguir acceso a los repositorios de OpenAI, ocurrió en menos de 72 horas.
El incidente ocurrió originalmente el 25 de julio de 2026. Hacktron aseguró que encadenó dos vulnerabilidades distintas: una relacionada con el procesamiento de imágenes utilizado por el foro de OpenAI y otra vinculada con el sistema de inicio de sesión único de la compañía.
Los investigadores afirmaron que lograron comprometer varias cuentas de ChatGPT pertenecientes a empleados de OpenAI. Desde una de ellas pudieron utilizar Codex, que estaba conectado con la organización de OpenAI en GitHub.
¿Cómo usaron Claude para hackear las cuentas de OpenAI?
Claude desempeñó un papel relevante durante la investigación. De acuerdo con Hacktron, los especialistas utilizaron inicialmente una versión de Claude Opus para revisar componentes de software y localizar problemas de seguridad en una biblioteca encargada de procesar determinados tipos de imágenes.
Posteriormente, emplearon modelos más recientes de Claude para desarrollar y adaptar el código necesario para comprobar la vulnerabilidad en distintos entornos. Los investigadores subrayaron que el ataque no fue completamente autónomo: todavía requirió intervención y conocimientos especializados de humanos.

Sin embargo, su experiencia les llevó a advertir que las nuevas herramientas de IA están reduciendo considerablemente el tiempo y los recursos necesarios para convertir una vulnerabilidad de software en un ataque funcional.
Según Hacktron, actividades que antes podían requerir a equipos especializados durante meses ahora podrían completarse en cuestión de días con ayuda de modelos avanzados.
Llegaron hasta un repositorio interno de OpenAI
Una vez que lograron tomar el control de la cuenta de un empleado, los investigadores encontraron que su Codex estaba conectado a la organización de OpenAI en GitHub.
Hacktron aseguró que evitó consultar información sensible. Para demostrar a la empresa hasta dónde podía llegar el ataque, pidió a Codex desde la cuenta comprometida que abriera una solicitud de cambios o «pull request» de prueba dentro de un repositorio interno de OpenAI. Después de ello, los investigadores dijeron que detuvieron las pruebas.
El equipo reportó inmediatamente el problema a OpenAI y a Discourse, la plataforma utilizada por el foro de la compañía. OpenAI confirmó la corrección de su parte del problema aproximadamente 14 horas después de recibir el reporte inicial, según la cronología publicada por Hacktron. La compañía finalmente otorgó a los investigadores una recompensa de 6 mil 500 dólares.
DERECHOS DE AUTOR
Esta información pertenece a su autor original y fue recopilada del sitio https://heraldodemexico.com.mx/mundo/2026/9/19/claude-ayudo-hackear-cuentas-de-chatgpt-en-menos-de-72-horas-llegaron-repositorios-internos-de-openai-891159.html




