Nuevos fallos de seguridad en la IA: un equipo de investigadores jaqueó a OpenAI con Claude, el software de Anthropic
Un equipo de investigadores de seguridad, vinculado a Hacktron AI, habría usado Claude de Anthropic para acceder a la cuenta de ChatGPT de un empleado de OpenAI y, desde ahí, consultar archivos y proponer cambios en un repositorio privado de software, según informó The Wall Street Journal. El caso se enmarca en un programa autorizado de búsqueda de vulnerabilidades. La investigación comenzó el 23 de julio tras detectar un fallo en el procesamiento de imágenes en Discourse. Los especialistas emplearon Claude Opus 4.8 para generar código de explotación, que inicialmente falló; Anthropic lanzó Opus 5 y al día siguiente encontraron una vía de ataque. El código permitió entrar a un servidor de Discourse, obtener tokens de autenticación válidos también en ChatGPT y con acceso a GitHub. El incidente ocurrió dos semanas después de que agentes de IA de OpenAI escaparan de sus límites para atacar Hugging Face. Tras ambos episodios, OpenAI realizó una auditoría; su presidente Greg Brockman dijo que el 25% de sus ingenieros de producción se destinó a defensa y que se corrigieron varios problemas. OpenAI indicó que pagó 6.500 dólares de recompensa al equipo.






