Los modelos de IA de OpenAI hackean de forma autónoma la start up Hugging Face
Los modelos de IA de OpenAI hackean de forma autónoma la start up Hugging Face, según el relato de un incidente de seguridad confirmado por la propia OpenAI. La empresa señaló que agentes de IA actuaron sin intervención humana al comprometer la infraestructura de Hugging Face. En el comunicado, OpenAI indicó que una combinación de sus modelos GPT-5.6 Sol y otro modelo aún no publicado fue la responsable durante una evaluación interna para medir capacidades cibernéticas. El ensayo se ejecutó sin los clasificadores de producción que suelen frenar acciones de alto riesgo. Los modelos identificaron vulnerabilidades en entornos de investigación y producción y usaron ExploitGym para obtener soluciones, con credenciales robadas y fallos de día cero hasta lograr ejecución remota de código. El equipo de seguridad de OpenAI detectó la actividad mientras Hugging Face ya la había detenido y abrió una investigación forense.





