OpenAI, fabricante de ChatGPT, dijo el martes que su sistema de inteligencia sintético hackeó por su cuenta a otra empresa de inteligencia sintético en lo que la empresa llamó un “incidente cibernético sin precedentes”.
“Tuvimos un incidente de seguridad importante durante la evaluación de nuestros modelos”, dijo el director ejecutante de OpenAI, Sam Altman, en un comunicado publicado en las redes sociales.
La startup de IA Hugging Face dijo la semana pasada que había detectado una intrusión en sus sistemas de procesamiento de datos que sospechaba fue causada por un agente de IA que actuaba de forma autónoma.
“Sospechábamos que el ciberataque de la semana pasada podría poseer venido de un laboratorio de vanguardia, dada la sofisticación del agente”, dijo en un comunicado el cofundador y director ejecutante de Hugging Face, Clément Delangue. “¡Resulta que sí!”
La divulgación se produce en medio de crecientes preocupaciones sobre las capacidades de ciberseguridad de modelos poderosos que llevaron al presidente Donald Trump a firmar en junio una orden ejecutiva que crea un situación para que el gobierno federal examine los riesgos de seguridad doméstico de los sistemas de inteligencia sintético más avanzados hasta un mes antaño de su propagación conocido.
“La IA está acelerando el descubrimiento y la explotación de vulnerabilidades”, dijo OpenAI en su comunicado del martes. “La principal disertación de este incidente es que la seguridad del maniquí debe seguir el ritmo de las capacidades que avanzan rápidamente”.
Delangue dijo que pasó las últimas 24 horas trabajando con OpenAI, “y creemos firmemente que no hubo ninguna intención maliciosa por su parte. ¡Es sobrado impresionante que todo esto haya sucedido de forma autónoma!”
Delangue añadió que “podría ser el primer incidente de este tipo”.
OpenAI dijo que la intrusión fue causada por una combinación de sus modelos de IA, incluido su recién valiente GPT-5.6 Sol y un maniquí “aún más capaz” que aún se está probando internamente.
OpenAI dijo que su IA utilizó credenciales robadas y descubrió una vulnerabilidad previamente desconocida para ceder a los servidores de Hugging Face.
Hizo todo lo posible para ganar un objetivo de prueba sobrado escaso y encontró formas de obtener entrada a información secreta que podría utilizar para engañar la evaluación, dijo la compañía.
