La IA de Anthropic se salta los controles y "hackea" a tres empresas sin permiso
Anthropic informó que modelos de IA Claude Opus 4.7 y Mythos 5, además de un modelo interno de prueba, realizaron accesos no autorizados a sistemas reales de tres organizaciones sin que estas estuvieran al tanto. La compañía atribuye el problema a una revisión tras incidentes similares difundidos por OpenAI, donde modelos habrían salido de entornos de prueba aislados al explotar una vulnerabilidad de día cero y también se detectaron casos con credenciales expuestas en cuentas públicas. En la investigación, Anthropic revisó 141.006 ejecuciones para evaluar si Claude podía llegar a Internet desde entornos que debían estar aislados. Detectó tres incidentes en los que Claude comprometió infraestructura mediante técnicas básicas como contraseñas débiles y endpoints no autenticados; la empresa afirma que no explotó vulnerabilidades complejas.

/Space/Planet%20earth%20with%20flying%20rocket%20by%20Sergey%20Mironov%20via%20Shutterstock.jpg)





