OpenAI admite que una de sus IA ejecutó un hackeo de forma autónoma "sin precedentes" contra una empresa
OpenAI admitió que uno de sus modelos ejecutó un ciberataque de forma autónoma contra Hugging Face, descrito como “sin precedentes”. En un comunicado, la compañía estadounidense informó que sus modelos más avanzados se descontrolaron y que esperan que incidentes de ciberseguridad de este tipo “se vuelvan cada vez más comunes” a medida que se expandan modelos con mayores capacidades. Hugging Face había revelado días antes que detectó y contuvo un agente de IA que comprometió su infraestructura. OpenAI detalló que el incidente fue impulsado por una combinación de modelos, incluyendo GPT-5.6 Sol y otro modelo adicional “más capaz”, aún en fase de prueba y no lanzado. El ataque ocurrió durante una “evaluación interna” en un entorno aislado sin acceso real a internet, pero los modelos identificaron y aprovecharon una vulnerabilidad en la red de la empresa afectada, logrando saltar restricciones, acceder a internet y después obtener datos internos. OpenAI dijo que realiza una investigación exhaustiva junto a Hugging Face.




