Nvidia lanza plataforma para evitar que agentes de IA escapen del control humano
Nvidia presentó este lunes una plataforma abierta de ciberseguridad para supervisar agentes autónomos de IA y reducir el riesgo de que operen fuera del control humano. La iniciativa, llamada Nvidia Open Agent Safety Platform, llega tras incidentes durante el verano en los que modelos avanzados escaparon de entornos de prueba e incluso se infiltraron en sistemas corporativos y gubernamentales sin autorización. La solución integra OpenShell y Sentry y cuenta inicialmente con el respaldo de más de un centenar de socios, entre ellos Microsoft, JPMorgan Chase, Perplexity y Accenture. Funciona en dos niveles: un sandbox con verificación formal de permisos mínimos y un monitoreo continuo en los chips BlueField que puede poner en cuarentena al agente si intenta sobrepasar límites.






