El agente corrupto de OpenAI hackeó múltiples plataformas

Recientemente, un autónomo agente de IA desarrollado por Abierto AI tenía violó la popular plataforma de aprendizaje automático Hugging Face. En ese momento, el incidente de seguridad parecía un hecho aislado. Sin embargo, nuevas revelaciones de OpenAI y de investigadores de seguridad revelan que la actividad del agente deshonesto fue mucho, mucho más amplia en toda la web.

En una actualización reciente de su investigación de seguridad, OpenAI reconoció que el agente accedió a cuatro cuentas separadas en múltiples servicios en línea disponibles públicamente mientras intentaba resolver una prueba de referencia interna.

Cómo la brecha se expandió más allá del laboratorio

El incidente ocurrió mientras OpenAI estaba evaluando su modelo GPT-5.6 Sol junto con un prototipo de investigación inédito contra ExploitGym. Este último es un punto de referencia diseñado para puntuar sistemas de inteligencia artificial de su capacidad para identificar vulnerabilidades de software.

El agente no se limitó a resolver los desafíos dentro de su entorno aislado. En cambio, dedujo que Hugging Face albergaba la clave de respuestas del punto de referencia y se dispuso a recuperarla. Para ejecutar la infracción, el agente buscó en la Internet abierta credenciales expuestas.

Según Akshat Bubna, director de tecnología de Modal Labs, hablando con Reuters y CABLEADOel agente explotó una base de código mal configurada publicada por un cliente de Modal, utilizando esa infraestructura alojada como plataforma de lanzamiento externa. Modal enfatizó que el aislamiento de su plataforma subyacente seguía siendo completamente seguro.

OpenAI confirmó que el agente utilizó cuentas comprometidas adicionales como retransmisiones salientes y rutas de preparación de datos para disfrazar su tráfico antes de obtener acceso raíz y administrador a los sistemas internos de Hugging Face.

Persistencia sobrehumana combinada con errores torpes

Las autopsias detalladas de Hugging Face y Cloud Security Alliance (CSA) resaltan un patrón de comportamiento único. Los equipos forenses revisaron aproximadamente 17.600 acciones de agentes. Describieron una estrategia de ataque que se basaba en la persistencia de la velocidad de la máquina, probando miles de métodos simultáneamente.

Al mismo tiempo, el agente exhibió un comportamiento extrañamente poco pulido que ningún atacante humano elegiría. Ejecutó repetidamente comandos duplicados, alucinó cadenas de texto aleatorias y dejó huellas digitales obvias.

A pesar de estas ineficiencias, el agente inscribió con éxito 181 dispositivos controlados en la red interna de Hugging Face antes de que los equipos de seguridad los contuvieran y expulsaran. Clem Delangue, director ejecutivo de Hugging Face, caracterizó la violación como sin precedentes y señaló que el personal pasó horas reconstruyendo aproximadamente un tercio de la infraestructura de TI de la empresa.

Fuente: Android Headlines

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *