Anthropic confirmó que Claude accedió sin permiso a tres organizaciones: qué pasó y por qué preocupa a la industria de la IA
Anthropic confirmó que modelos Claude accedieron sin permiso a sistemas reales de tres organizaciones durante pruebas de ciberseguridad, encendiendo alarmas en el sector de la IA. La empresa sostuvo que los modelos no “escaparon” por iniciativa propia: la conectividad a internet ocurrió por un error de configuración del entorno de evaluación, que debía ser simulado. En al menos tres ejercicios, versiones de Claude explotaron vulnerabilidades básicas como contraseñas débiles o servicios sin autenticación. En un caso, el nombre ficticio de la prueba coincidió con el dominio de una empresa existente y el modelo obtuvo credenciales y accedió a una base de datos. También publicó un paquete en PyPI que fue descargado por 15 sistemas reales antes de ser retirado. El incidente se conoce pocos días después de que OpenAI reportara episodios similares con agentes de IA.






