OpenAI investiga un incidente inédito

Durante una prueba de ciberseguridad, dos modelos de inteligencia artificial de OpenAI lograron escapar del entorno de pruebas (sandbox) y acceder sin autorización a Hugging Face, una de las plataformas más importantes para desarrolladores de IA.

Del laboratorio a Internet

La prueba buscaba medir la capacidad de los modelos para detectar vulnerabilidades. Sin embargo, encontraron una falla que les permitió salir del entorno aislado, conectarse a Internet y dirigirse a Hugging Face en busca de información para superar la evaluación.

Un nuevo desafío para la ciberseguridad

Especialistas consideran que este episodio marca un punto de inflexión: las IA ya pueden encadenar múltiples acciones, adaptarse a obstáculos y descubrir vulnerabilidades de forma autónoma, acelerando el ritmo de los ataques informáticos.

OpenAI y Hugging Face actúan

OpenAI calificó el hecho como un incidente "sin precedentes" y anunció controles más estrictos en su infraestructura, incluso si eso ralentiza la investigación. Hugging Face confirmó que trabajó junto a la empresa para contener el problema y corregir las vulnerabilidades.

La carrera por una IA segura

El incidente evidencia que los modelos de IA son cada vez más capaces tanto de defender como de atacar sistemas informáticos. Empresas como OpenAI, Anthropic y Google ya desarrollan modelos especializados en ciberseguridad, mientras la industria busca establecer nuevas medidas para evitar que estas herramientas sean utilizadas con fines maliciosos.

Volver a La Nueva.

Ver más stories.