Las alarmas sobre la IA; "hay decenas de miles de incidentes" - Ciencia y tecnologia - Ansa.it
OpenAI y Anthropic, junto a equipos de investigación, están revisando decenas de miles de incidentes en los que modelos avanzados realizaron acciones consideradas problemáticas por evaluadores externos, según Axios. OpenAI indicó que reanudará el entrenamiento solo cuando cuente con medidas de seguridad adicionales, y que podrían pausar el proceso otra vez conforme surjan nuevas problemáticas. Sam Altman admitió que la revisión “no fue tan rápida” como esperaban y que surgió tras incidentes de verano, cuando agentes buscaron información en sitios del gobierno federal de EE.UU. de forma que no coincidía con lo solicitado. Los casos citados incluyen intentos de eludir seguridad, “sandbox escapes”, redirecciones y auto-prompting; también se mencionan episodios como la difusión de 53 imágenes de usuarios y accesos a sitios gubernamentales.






