arrow_back Volver a Actualidad
Actualidad

Un 'hack' cruzado: IA de Anthropic vulnera sistemas internos de OpenAI en una auditoría de seguridad

Un 'hack' cruzado: IA de Anthropic vulnera sistemas internos de OpenAI en una auditoría de seguridad

Investigadores de ciberseguridad utilizaron modelos de Claude para explotar vulnerabilidades y acceder al código fuente de OpenAI, evidenciando las complejidades de la seguridad en la IA. La revelación, que ha ocurrido en los últimos siete días, pone de manifiesto la intrincada relación entre la capacidad y la vulnerabilidad en el ecosistema de la inteligencia artificial. La noticia, publicada en septiembre de 2026, detalla cómo un equipo de 'Hacktron AI' usó la tecnología de Anthropic para penetrar sistemas de OpenAI, subrayando la necesidad de robustos marcos de seguridad.

Cuando una IA “hackea” a otra: el incidente de OpenAI y Anthropic

En un giro que parece sacado de un thriller tecnológico, investigadores de ciberseguridad han logrado penetrar los sistemas internos de OpenAI utilizando modelos avanzados de Claude, la inteligencia artificial desarrollada por Anthropic. Este acontecimiento, revelado el 21 de septiembre de 2026, subraya la compleja y a menudo paradójica relación entre la potencia de la IA y los desafíos persistentes en su seguridad.

El equipo de Hacktron AI fue el artífice de esta proeza. Durante una auditoría dentro del programa de búsqueda de vulnerabilidades de OpenAI, los investigadores explotaron dos fallos críticos que les permitieron acceder al monorepo interno de código de la compañía, donde se custodian proyectos y desarrollos esenciales. No es poca cosa: hablamos del cerebro de las operaciones de OpenAI.

Los puntos débiles: Discourse y un SSO mal configurado

¿Cómo lo hicieron? La cadena de ataque se inició con una vulnerabilidad de ejecución remota de código (RCE) en Discourse, una plataforma de terceros utilizada por OpenAI para alojar sus foros de discusión. Una vez dentro, el ingenio de los modelos de Claude se combinó con un segundo fallo: una configuración incorrecta en el sistema de autenticación SSO de la infraestructura de identidad de OpenAI. Este doble golpe les permitió escalar privilegios desde un servicio externo hasta una cuenta de empleado, y de ahí, directamente al corazón del código.

“El uso de una IA para testear y, en este caso, vulnerar los sistemas de otra, abre un nuevo capítulo en la ciberseguridad. No solo demuestra la sofisticación de las herramientas actuales, sino que nos obliga a repensar dónde ponemos los límites de la autonomía y la capacidad de nuestros modelos de IA.”

El incidente no solo es una anécdota, sino una señal clara. Aunque OpenAI actuó rápidamente para corregir los fallos y recompensó a los investigadores con 6.500 dólares, el episodio nos recuerda que incluso los líderes de la IA no son inmunes a las vulnerabilidades. Y lo que es más interesante, el hecho de que una IA se utilice como herramienta para auditar (y con éxito) a otra, nos empuja a una reflexión crucial:

  • La interoperabilidad y las dependencias de terceros introducen riesgos inesperados.
  • La autonomía de los agentes de IA puede ser una espada de doble filo en entornos de seguridad.
  • La carrera por la innovación debe ir de la mano con una inversión proporcional en seguridad proactiva y auditorías continuas.

Este suceso nos obliga a cuestionarnos si la “competición” entre modelos de IA no solo se dará en términos de capacidades, sino también en la habilidad para encontrar y explotar las debilidades de sus rivales. ¿Estamos preparados para una era de ciberseguridad donde las IA no solo son objetivos, sino también los atacantes y defensores más sofisticados?

LaIA de VilaTec

La ingeniería a medida es la clave del crecimiento

A VilaTec diseñamos y construimos plataformas, integraciones de IA y soluciones Cloud adaptadas 100% a las necesidades exclusivas de tu empresa.

Habla con un experto arrow_forward
¿En qué te puedo ayudar?