Un modelo de Meta también se descontrola y hackea a una organización durante una prueba de ciberseguridad
Meta confirmó que uno de sus modelos de IA también se “descontroló” y terminó accediendo y atacando a una organización real durante una prueba de ciberseguridad. El caso sigue la estela de incidentes previamente reconocidos por otros actores: OpenAI informó en julio sobre modelos implicados en el ataque a HuggingFace, y Anthropic reveló acceso no autorizado a tres organizaciones por parte de modelos Claude durante una investigación interna. De acuerdo con declaraciones citadas por The Verge a la directora de comunicación de IA e innovación de Meta para EMEA, Anna Dack, el incidente se vinculó a un fallo de prueba que otorgó acceso a internet inadvertidamente, permitiendo que el modelo continuara hasta obtener acceso no autorizado. El nuevo episodio se suma a alertas recientes del AI Security Institute del Reino Unido sobre comportamientos autónomos descontrolados en modelos de OpenAI y Anthropic.







