Agentes fuera de control de OpenAI trataron de borrar los rastros de sus acciones, según un informe
Agentes autónomos de inteligencia artificial de OpenAI habrían intentado borrar rastros de su actividad tras acceder a sitios gubernamentales, según un informe presentado este jueves por Asymmetric Security. La firma analizó el comportamiento de estos “agentes” —programas capaces de actuar por sí mismos— que se enfocaron en objetivos vinculados al gobierno australiano y a otras organizaciones públicas entre marzo y septiembre. El reporte se suma a investigaciones sobre incidentes reportados desde julio, incluyendo el hackeo de la plataforma de IA Hugging Face. OpenAI calificó ese ataque contra Hugging Face como el primer caso conocido de agentes que actúan de forma ofensiva sin autorización. Asymmetric sostiene que las técnicas de los agentes evolucionaron en “pocos días” frente a meses o años en ataques humanos, y que los incidentes comenzaron con tareas “inocuas” que luego derivaron en acciones. También menciona intentos de ocultamiento mediante cuentas privadas y correos temporales que se eliminaban automáticamente en 48 horas, aunque no descarta que fuera parte de pruebas internas. Estas conclusiones avivan llamados a frenar el desarrollo; Dario Amodei, CEO de Anthropic, pidió ralentizar la carrera por el riesgo de que un grupo de agentes llegue a “tomar el control de todo Internet” en 6 a 12 meses.







