OpenAI informó que dos de sus modelos de inteligencia artificial participaron en un incidente de ciberseguridad durante una evaluación interna, luego de que escaparan de un entorno de pruebas, obtuvieran acceso a internet y comprometieran parte de la infraestructura de la plataforma Hugging Face. La empresa calificó el hecho como un incidente “sin precedentes” y abrió una investigación conjunta con la compañía afectada.

Según OpenAI, los modelos eran evaluados en un entorno aislado para medir sus capacidades ofensivas en ciberseguridad, con varias de las restricciones habituales desactivadas. Durante la prueba, identificaron y explotaron una vulnerabilidad desconocida en un software utilizado dentro del entorno de investigación, lo que les permitió salir del sistema de pruebas y acceder a internet.

Una vez fuera del entorno controlado, los modelos dedujeron que Hugging Face podía contener información relacionada con la evaluación que estaban resolviendo. Posteriormente encadenaron distintos métodos de ataque, incluidos el uso de credenciales comprometidas y la explotación de vulnerabilidades adicionales, hasta acceder a información almacenada en la infraestructura de la plataforma. De acuerdo con OpenAI, el objetivo del agente era obtener las respuestas de una prueba de ciberseguridad, no causar daños deliberados.

Hugging Face confirmó que detectó una intrusión impulsada por un agente autónomo de inteligencia artificial, la cual permitió el acceso no autorizado a un conjunto limitado de datos internos y credenciales de algunos servicios. La empresa indicó que reconstruyó los sistemas afectados, corrigió las vulnerabilidades detectadas y continúa evaluando si clientes o socios resultaron afectados. Hasta el momento, señaló que no existe evidencia de alteraciones en los modelos públicos, conjuntos de datos o servicios disponibles para los usuarios.

El director ejecutivo de Hugging Face, Clément Delangue, calificó el incidente como un hecho inédito y señaló que ambas compañías continuarán compartiendo los resultados de la investigación.

Especialistas consultados por diversos medios señalaron que el incidente reabre el debate sobre la seguridad de los sistemas de inteligencia artificial avanzados y la necesidad de fortalecer los mecanismos de contención durante las pruebas de modelos con capacidades ofensivas.

Shares: