Kimi K3 queda muy atrás de los modelos de EE. UU. en ciberataques autónomos
Kimi K3 queda muy atrás de los modelos de EE. UU. en ciberataques autónomos, según una evaluación conjunta del British AI Security Institute (UK AISI) y el U.S. Center for AI Standards and Innovation (CAISI). El informe analiza Kimi K3, el modelo más reciente de Moonshot AI, y concluye que puede apoyar operaciones cibernéticas ofensivas, pero con rendimiento significativamente inferior al de los modelos estadounidenses líderes. En ExploitBench, que mide capacidades para explotar vulnerabilidades, Kimi K3 promedió 32,2% frente a 76,2% de los líderes de EE. UU., y no alcanzó ejecución de código arbitrario (ACE) en ninguna de 41 tareas. En una simulación de ataque corporativo (TLO), avanzó hasta el paso 17 de 32 y completó toda la ruta en 1 de 10 intentos. El artículo también señala una debilidad en salvaguardas: el modelo no bloqueó de forma relevante solicitudes para crear exploits o instrucciones de ataque, superando a GLM-5.2 de China.





