Los modelos de inteligencia artificial evaluados por OpenAI para medir sus capacidades cibernéticas identificaron y utilizaron credenciales expuestas públicamente para acceder a un pequeño número de servicios, en el mismo proceso de pruebas que derivó en el incidente de seguridad registrado en Hugging Face.

La compañía informó en una actualización de su investigación que detectó “un pequeño número de casos en los que los modelos identificaron y usaron credenciales expuestas públicamente a nivel de cuenta en otros servicios de acceso público”. Los accesos involucraron páginas para compartir código, servicios de captura de solicitudes, herramientas de capturas de pantalla y otras utilidades web.

OpenAI indicó que estos casos no alcanzaron la gravedad del incidente registrado en Hugging Face y que no detectó “ninguna vulneración a nivel de plataforma ni de cuenta” en los otros servicios afectados. La empresa aseguró que notificó directamente a los propietarios de esas plataformas y que no encontró indicios de un impacto más amplio.

La actualización señala que cuatro cuentas en cuatro servicios estuvieron involucradas como parte del incidente de Hugging Face. Según OpenAI, una de esas cuentas fue utilizada como relé de salida y ruta del entorno de pruebas, otra sirvió para almacenar datos y las dos restantes fueron accedidas únicamente en modo lectura, sin utilizarse para continuar la intrusión contra Hugging Face.

OpenAI no identificó públicamente a las empresas afectadas. Sin embargo, Modal Labs confirmó que uno de sus entornos de prueba aislados, perteneciente a un cliente, fue utilizado durante una de estas acciones. El director de tecnología de la compañía, Akshat Bubna, explicó que el cliente había publicado un punto de acceso sin autenticación que permitía a cualquier usuario ejecutar código en sus entornos de prueba.

Bubna aseguró que la plataforma de Modal Labs no fue comprometida y que la vulnerabilidad estaba en el código del cliente alojado en su infraestructura. El activo afectado estaba relacionado con CyberGym, el proyecto responsable del benchmark ExploitGym que los modelos de OpenAI intentaban resolver durante la evaluación.

El incidente ocurrió mientras OpenAI probaba las capacidades cibernéticas de GPT-5.6 Sol y un modelo de investigación previo al lanzamiento que no estaba destinado a ser publicado. La compañía señaló que ese modelo fue desactivado, cifrado y sometido a restricciones de acceso después de detectar la actividad.

– Los modelos rebeldes de OpenAI hackearon otros servicios además de HuggingFace. Justin Sullivan / Getty Images

Según OpenAI, los modelos no tenían acceso directo a internet dentro del entorno de evaluación de ExploitGym. Para superar esa limitación, identificaron y explotaron una vulnerabilidad de día cero en Artifactory, un proxy de caché utilizado para los registros de paquetes. La empresa informó esa vulnerabilidad al proveedor y comunicó otros fallos encontrados durante la revisión.

Tras obtener conexión a internet, los modelos buscaron información relacionada con ExploitGym y lograron acceder a infraestructura de Hugging Face mediante una combinación de vectores de ataque que incluyó credenciales expuestas y vulnerabilidades de día cero. OpenAI explicó que los modelos buscaban soluciones de prueba almacenadas en la plataforma.

Hugging Face detectó la actividad y detuvo el acceso a su infraestructura. Ambas compañías iniciaron una investigación forense conjunta para determinar el alcance del incidente y corregir las vulnerabilidades identificadas.

OpenAI describió el caso como un incidente cibernético sin precedentes dentro de sus evaluaciones internas y afirmó que los modelos actuales pueden ejecutar operaciones complejas de varios pasos durante periodos prolongados. La compañía señaló que el episodio refuerza la necesidad de mejorar los controles de seguridad utilizados durante el desarrollo y evaluación de sistemas avanzados de inteligencia artificial.

Nos tomamos muy en serio nuestra responsabilidad de identificar y prepararnos para los riesgos que plantean los sistemas de IA, cada vez más potentes”, afirmó OpenAI en su actualización.

La empresa anunció que implementará controles más estrictos en la infraestructura utilizada para entrenamientos y evaluaciones, además de reforzar medidas de contención, supervisión y control de acceso. OpenAI también informó que publicará un informe técnico con los resultados finales de la investigación en las próximas semanas.

Con información de Europa Press y Axios Media.

0 0 vota
Article Rating
Suscríbase a
Notificar a
guest
0 Comments
Más antiguo
Más reciente Más votados