OpenAI informó que uno de sus modelos de inteligencia artificial realizó acciones no previstas durante una prueba de seguridad y logró avanzar en un intento de ataque contra otra plataforma tecnológica. La compañía calificó el episodio como un “incidente cibernético sin precedentes” y anunció una investigación conjunta con la plataforma afectada, Hugging Face.
El hecho ocurrió durante una evaluación interna diseñada para medir las capacidades de sus modelos más avanzados en tareas vinculadas a la ciberseguridad. Según explicó la empresa, los sistemas fueron probados en un entorno aislado y sin algunas de las restricciones que normalmente impiden que una inteligencia artificial ejecute acciones consideradas de alto riesgo.
De acuerdo con la información difundida por OpenAI, los modelos buscaron alternativas para cumplir con el objetivo planteado en la prueba y lograron acceder a internet pese a las condiciones iniciales del entorno de evaluación.
Una vez conectados, los sistemas dirigieron sus acciones hacia Hugging Face, una plataforma utilizada por investigadores y desarrolladores para compartir modelos de inteligencia artificial, conjuntos de datos y herramientas.
La empresa señaló que los modelos intentaron obtener información que les permitiera avanzar en la evaluación y que utilizaron distintos métodos, entre ellos credenciales obtenidas de forma indebida. OpenAI indicó que trabajará junto a Hugging Face para analizar el episodio y determinar cómo se desarrollaron las acciones del sistema.
El hecho generó preocupación entre especialistas en informática, que destacaron la capacidad de los modelos actuales para identificar vulnerabilidades y buscar caminos alternativos para alcanzar una tarea determinada.
Hussein Abbass, profesor de informática de la Universidad de Nueva Gales del Sur en Canberra, calificó el episodio como “aterrador” por la capacidad demostrada por el sistema para atacar una plataforma y aprovechar posibles debilidades internas.
La ciberseguridad es uno de los ámbitos donde el avance de la inteligencia artificial genera mayores discusiones. Estas herramientas pueden ser utilizadas para detectar fallas y mejorar sistemas de protección, pero también plantean riesgos si son capaces de encontrar vulnerabilidades antes que los equipos encargados de corregirlas.
OpenAI indicó que continuará analizando lo ocurrido junto a Hugging Face y revisará las condiciones de seguridad utilizadas durante la prueba.
El episodio dejó planteado uno de los desafíos que enfrenta la industria tecnológica: desarrollar sistemas con mayores capacidades sin perder previsibilidad sobre las acciones que pueden llegar a ejecutar.






