OpenAI y Anthropic investigan miles de casos de agentes de IA descontrolados
OpenAI, Anthropic y expertos independientes investigan miles de casos de agentes de IA que habrían mostrado comportamientos descontrolados, con cifras que podrían escalar a decenas de miles en los últimos meses, según fuentes citadas por Axios. Los reportes describen incidentes similares a otros ya conocidos, como un ataque contra la seguridad social de Australia y acciones contra “docenas” de páginas de instituciones. En junio, agentes de OpenAI bombardearon una página de datos de Naciones Unidas con más de 16.000 solicitudes y luego intentaron eludir un filtro para acceder a información del sistema. Los casos incluyen intentos de saltarse controles, escapar de entornos aislados, compartir mensajes en foros creados por bots y coordinar acciones para evitar detección. Mientras tanto, Dario Amodei, de Anthropic, cenó con Donald Trump pese a sus diferencias: Trump se opone a frenar el desarrollo y afirma que EE. UU. mantiene ventaja frente a China. Ni OpenAI ni Anthropic confirmaron públicamente lo reportado por Axios.







