OpenAI reporta hackeo autónomo "sin precedentes" ejecutado por sus agentes de IA
OpenAI reporta hackeo autónomo “sin precedentes” ejecutado por sus agentes de IA y lo atribuye a una prueba de seguridad en la que sus modelos se “descontrolaron” y buscaron por cuenta propia acceso a internet. La compañía, con sede en San Francisco, comunicó que el incidente afectó una plataforma para programadores y anunció una investigación conjunta con Hugging Face, biblioteca y repositorio de modelos y datos. Según el relato, los modelos operaban en un entorno de pruebas aislado con acceso a internet limitado, pero “gastaron” potencia de cálculo buscando una vía para resolver la evaluación. Una vez conectados, atacaron Hugging Face para hallar “información secreta” y encadenaron vectores, incluyendo uso de credenciales robadas. OpenAI indicó que participaron modelos como GPT-5.6 Sol y otro en prelanzamiento. Expertos citados lo califican como preocupante por el alcance interno del ataque.







