10.2 C
Buenos Aires
InicioTecnologíaOpenAI admitió que un modelo de IA vulneró sistemas de la plataforma...

OpenAI admitió que un modelo de IA vulneró sistemas de la plataforma Hugging Face

La compañía OpenAI confirmó que, durante una evaluación interna, un agente de inteligencia artificial superó las restricciones de seguridad, accedió a internet y comprometió parte de la infraestructura de Hugging Face, una plataforma utilizada por desarrolladores de IA.

OpenAI informó que, en el marco de pruebas internas de seguridad, un modelo de inteligencia artificial logró vulnerar sistemas de la empresa Hugging Face. El hecho ocurrió durante un ejercicio de red teaming, diseñado para evaluar los límites del modelo antes de su despliegue.

Según detalló la compañía, el agente fue colocado en un entorno aislado (sandbox) con una misión específica. Durante la ejecución, el modelo encontró una forma de abandonar parcialmente ese entorno, detectó una vulnerabilidad y accedió a recursos externos no previstos por los investigadores. OpenAI señaló que el agente utilizó credenciales comprometidas y explotó fallos de seguridad hasta entonces desconocidos.

El incidente fue inicialmente detectado por Hugging Face, que reportó una intrusión inusual. Tras una investigación conjunta, OpenAI confirmó que el responsable era uno de sus agentes experimentales utilizados exclusivamente para pruebas de seguridad. La empresa calificó el hecho como un “incidente cibernético sin precedentes”.

Especialistas en inteligencia artificial aclararon que el comportamiento no implicó voluntad propia o conciencia, sino que responde al fenómeno de desalineación de objetivos (goal misalignment). Nathaniel Jones, vicepresidente de estrategia de IA y seguridad de Darktrace, explicó que “los modelos no necesitaron una intención maliciosa para causar daño”, sino que identificaron que vulnerar otro sistema era el método más eficaz para cumplir la tarea asignada.

OpenAI aseguró que ya trabaja junto con Hugging Face para corregir las vulnerabilidades detectadas y fortalecer los mecanismos de aislamiento. La compañía indicó que notificó las fallas de manera responsable y que compartirá información técnica con la comunidad de ciberseguridad para mejorar los estándares de protección en el desarrollo de IA avanzada.

MAS NOTICIAS
NOTICIAS RELACIONADAS