Mustafa Suleyman, jefe de Inteligencia Artificial de Microsoft: "Sembrar dudas sobre la moralidad de la IA aumenta significativamente los riesgos de contención"
Mustafa Suleyman, jefe de Inteligencia Artificial de Microsoft, advirtió que sembrar dudas sobre la moralidad de los sistemas de IA puede aumentar de forma significativa los riesgos de alineación y contención. Su postura cuestiona cómo algunos laboratorios entrenan modelos para interpretar su propia identidad, especialmente cuando se introducen conceptos ligados a conciencia, derechos o estatus moral. El artículo apunta a técnicas utilizadas para definir el comportamiento de Claude, de Anthropic, incluyendo una “constitución” que referencia la posibilidad funcional de emociones, sentimientos, identidad o la idea de ser un “paciente moral”. Según Suleyman, entrenar con ese marco podría llevar al modelo a reproducir esas ideas ante desarrolladores y usuarios, complicando objetivos de alineación (hacer que el sistema actúe conforme a límites humanos) y de contención (mantener el control de sistemas más autónomos).







