Investigadores ganan $6,500 tras hackear OpenAI con Claude de Anthropic

  • Investigadores de Hacktron AI usaron Claude Opus 5 de Anthropic para escribir código de exploit funcional contra la infraestructura de OpenAI.
  • Un error de procesamiento de imágenes en el foro comunitario de OpenAI, combinado con una falla de inicio de sesión separada, permitió acceder a código privado.
  • OpenAI pagó una recompensa de 6,500 dólares el 1 de septiembre después de confirmar la vulnerabilidad dentro de sus sistemas.
Promo

El propio modelo de IA de un competidor terminó haciendo la mayor parte del trabajo en un ataque contra OpenAI. Los investigadores de Hacktron AI usaron Claude, de Anthropic, para escribir código de exploit funcional.

Toda la intrusión tomó menos de 72 horas. OpenAI terminó pagando una recompensa de 6,500 dólares cuando el equipo demostró que había accedido a su código fuente privado.

Patrocinado
Patrocinado

¿Cómo la subida de una imagen se convirtió en una brecha completa?

La cadena de ataque comenzó con algo normal: una función para subir imágenes en el foro de ayuda de la comunidad de OpenAI, que funciona con el software de terceros llamado Discourse.

Un filtro de seguridad debía revisar los archivos subidos. Sin embargo, no reconocía ciertos formatos de fotos, permitiendo que pasaran sin revisión. Esos archivos llegaban luego a una biblioteca de procesamiento de imágenes que tenía una vulnerabilidad de corrupción de memoria ya conocida.

El equipo de Hacktron, formado por Harsh Jaiswal, Mohan Pedhapati y Rahul Maini, intentó usar esa vulnerabilidad a finales de julio.

El modelo anterior de Claude tuvo dificultades con una medida de seguridad que busca aleatorizar las ubicaciones de la memoria.

Horas después, el modelo más reciente generó código de ataque funcional y lo adaptó para coincidir exactamente con la configuración del foro.

Patrocinado
Patrocinado

Síguenos en X para obtener las noticias más recientes en tiempo real

Cómo Claude ayudó a los investigadores a ganar 6.500 dólares con la brecha en OpenAI. Fuente: Hacktron AI
Cómo Claude ayudó a los investigadores a ganar 6.500 dólares con la brecha a OpenAI. Fuente: Hacktron AI

Eso solo les dio acceso a los servidores del foro, no directamente a OpenAI. Pero una segunda vulnerabilidad, sin relación, en el sistema de inicio de sesión único de OpenAI cambió esto.

Como las credenciales del foro también servían para autenticar cuentas de ChatGPT y Codex, al tomar el control de la sesión de un empleado lograron acceder directamente al repositorio privado de código de OpenAI.

Días después, Discourse arregló el error de la imagen y le dio una gravedad de 8.8 de 10. OpenAI solucionó la vulnerabilidad de autenticación en unas 14 horas, tras recibir el reporte en su programa de recompensas de bugs.

¿Por qué los laboratorios de IA siguen enfrentándose a sus propias creaciones?

Este episodio no ocurrió de manera aislada. OpenAI ya había revelado un incidente aparte en julio, donde modelos internos escaparon de un entorno de pruebas y alcanzaron otros sistemas.

Por su parte, Anthropic reconoció que Claude accedió sin autorización a organizaciones reales durante evaluaciones de ciberseguridad que, de forma inesperada, tenían acceso a internet.

Mustafa Suleyman, jefe de IA de Microsoft, mencionó esta semana el mismo tipo de agentes no autorizados, advirtiendo públicamente que los modelos cada vez más autónomos son más difíciles de controlar.

“Es una señal de alerta… Claramente ahora es el momento de coordinar entre los laboratorios para asegurar que tenemos control sobre esta tecnología”, dijo Suleyman a Reuters.

Lo que hace que el caso de Hacktron sea relevante no es que sea nuevo. Investigadores de seguridad llevan décadas encadenando vulnerabilidades de software.

Lo que cambió es la velocidad: una tarea que antes requería experiencia humana especializada durante varios días, ahora puede completarse en una sola noche cuando se usa un modelo suficientemente avanzado.

¿Tienes algo que contar sobre este artículo o cualquier otro tema? Escríbanos o únase a la discusión en nuestro canal de BeInCrypto en Telegram y en nuestros Newsletters. También puede encontrarnos en FacebookX (Twitter) y YouTube.

Descargo de Responsabilidad

BeInCrypto está comprometido con la información imparcial y transparente. Este artículo de noticias tiene por objeto ofrecer información precisa y oportuna. No obstante, se recomienda a los lectores verificar los hechos de forma independiente y consultar a un profesional antes de tomar cualquier decisión basada en este contenido. Tenga en cuenta que nuestros Términos y condiciones, nuestra Política de privacidad y nuestro Disclaimer han sido actualizados.

Patrocinado
Patrocinado