# Hackean OpenAI usando a Claude de Anthropic en menos de 72 horas

> Un grupo de investigadores utilizó el modelo de inteligencia artificial de Anthropic para desarrollar un ataque que vulneró los sistemas de OpenAI.

Por Yorbeth Nagel Chacín · 19 de septiembre de 2026 · Tecnología

![Smartphone showing OpenAI ChatGPT in focus, on top of an open book, highlighting technology and learning.](https://panorama.onl/app/uploads/28fda053e8f9cdfb-scaled.webp)

Un equipo de especialistas en ciberseguridad logró acceder al código fuente privado de OpenAI utilizando el modelo de inteligencia artificial Claude, desarrollado por Anthropic, para escribir código de ataque funcional en un proceso que tomó menos de 72 horas.

$6,500 Recompensa pagada por OpenAI tras la demostración de la brecha

Claves

- El ataque [comenzó](https://www.forbes.com/sites/siladityaray/2026/09/18/security-researchers-hacked-into-openai-using-anthropics-claude/) a través de una función para subir imágenes en el foro de la comunidad de OpenAI.

- Claude generó [código de ataque funcional y lo adaptó](https://www.hacktron.ai/blog/hacking-openai#hacking-communityopenaicom) para superar las medidas de seguridad de memoria.

- Una segunda vulnerabilidad en el sistema de inicio de sesión único permitió alcanzar los repositorios privados.

## La cadena de vulnerabilidades

La intrusión llevada a cabo por Harsh Jaiswal, Mohan Pedhapati y Rahul Maini, integrantes del equipo de Hacktron AI, se originó en una herramienta de subida de archivos dentro del foro de ayuda de la comunidad, gestionado mediante el software de terceros Discourse.

El filtro de seguridad implementado no reconoció determinados formatos fotográficos, lo que permitió que los archivos avanzaran hacia una biblioteca de procesamiento de imágenes afectada por una vulnerabilidad conocida de corrupción de memoria. Tras superar las restricciones iniciales, el modelo más reciente de Claude logró redactar las instrucciones necesarias para materializar la brecha.

## El acceso a los repositorios y la respuesta institucional

Aunque el exploit inicial otorgó control únicamente sobre los servidores del foro, una falla independiente en el sistema de autenticación de OpenAI facilitó la toma de control de la sesión de un empleado, conectando las credenciales con cuentas de ChatGPT y Codex para ingresar al repositorio privado de código.

Tras recibir el reporte mediante el programa de recompensas de bugs, la plataforma Discourse corrigió el fallo original con una calificación de gravedad de 8,8 sobre 10, mientras que OpenAI solucionó la brecha de autenticación en aproximadamente 14 horas.

Advertencia sobre agentes autónomos

Mustafa Suleyman, directivo de Microsoft, [mencionó](https://www.reuters.com/legal/litigation/microsoft-drafts-code-conduct-keep-its-ai-under-human-control-2026-09-14/) recientemente que los modelos altamente autónomos representan un desafío creciente de control y exigen mayor coordinación entre los laboratorios tecnológicos.

---

**Fuente:** https://panorama.onl/tecnologia/hackean-openai-usando-a-claude-de-anthropic-en-menos-de-72-horas-20260919-0232.html
Publicado por Panorama Online — contenido de libre lectura; se permite citar con atribución y enlace a la URL original.
