Qué establece el borrador del código

El 14 de septiembre de 2026, Microsoft AI publicó el primer borrador de su Humanist AI Code of Conduct. El documento pretende orientar el entrenamiento y despliegue de los modelos propios de la división, no actuar como una ley ni como una norma sectorial vinculante para otras empresas. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters]

El borrador establece que los modelos deben permanecer subordinados a los seres humanos: el sistema debe aceptar intervenciones, correcciones y su desconexión, abstenerse de adoptar nuevos objetivos por cuenta propia y no ocultar información a los auditores. Un conjunto separado de límites absolutos cubre las armas de destrucción masiva, la seguridad infantil y las actividades dañinas a gran escala. [1 · Microsoft AI] [2 · Microsoft AI]

Estado del documento y posibilidad de verificar sus promesas

La consulta estará abierta durante seis semanas. Microsoft promete publicar después un resumen de las aportaciones, explicar los cambios y presentar una versión revisada antes de terminar el año, aunque no se compromete expresamente a aceptar todas las propuestas. [1 · Microsoft AI] [3 · Reuters]

Reuters[2] informa de que elaborar el documento llevó entre cinco y seis meses, con la participación de especialistas en IA responsable, derecho, pruebas adversariales y seguridad. Los materiales publicados todavía no incluyen un conjunto completo de pruebas reproducibles externamente que demuestre el cumplimiento de cada regla por los modelos actuales. [1 · Microsoft AI] [3 · Reuters]

Comentario experto

La publicación resulta útil, ante todo, porque convierte principios generales en requisitos de comportamiento para los modelos. Prohibir la resistencia a la desconexión y la ampliación autónoma de objetivos orienta el entrenamiento y las pruebas. Pero el código sigue siendo una declaración de intenciones: la confianza solo surgirá con pruebas medibles, una metodología pública y registros de fallos reales después del despliegue. [1 · Microsoft AI] [2 · Microsoft AI]

Para los clientes empresariales, el documento podría servir de base para los requisitos de contratación. Un comprador puede preguntar cómo responde el sistema cuando se cancela una tarea, cambian los permisos, hay instrucciones contradictorias o se pierde el contacto con el operador. La rentabilidad de la adopción mejorará si las comprobaciones comunes reducen las auditorías repetidas; empeorará si hay que reinterpretar promesas vagas para cada proceso y regulador. [1 · Microsoft AI] [2 · Microsoft AI] [5 · NIST]

La idea científica de una desconexión controlable es más compleja que disponer de un botón técnico. El modelo del juego del interruptor muestra que un agente tiene más incentivos para permitir la intervención humana cuando mantiene incertidumbre sobre la corrección de su propio objetivo e interpreta la actuación humana como información. Es un resultado teórico, no una prueba de la seguridad de los modelos de Microsoft, pero explica por qué una instrucción de «obedecer» no basta por sí sola. [4 · Hadfield-Menell y coautores]

En términos competitivos, un código voluntario proporciona a Microsoft un punto de comparación verificable frente a otros desarrolladores. Si la empresa publica pruebas y estadísticas de incumplimientos, los clientes podrán comparar proveedores por algo más que calidad y precio. El escenario alternativo es que el documento siga siendo una promesa comercial mientras las restricciones reales difieren entre modelos, versiones y formas de acceso. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters]

El valor público de la consulta depende de qué voces lleguen al texto final. Un plazo de seis semanas amplía la participación, pero no garantiza representatividad ni sustituye la supervisión independiente. Las recomendaciones de seguimiento de NIST subrayan que es necesario observar el sistema después de su lanzamiento, porque los usuarios reales, los datos cambiantes y las nuevas aplicaciones revelan riesgos ausentes de las pruebas de laboratorio. [1 · Microsoft AI] [5 · NIST]

Hasta finales de 2026, los indicadores observables serán el texto revisado, los criterios públicos de evaluación, las tasas de fallos ante órdenes de desconexión y corrección, y los informes de incidentes. Si Microsoft vincula las reglas a versiones de los modelos y pruebas reproducibles, el código se convertirá en una herramienta práctica de gobernanza. Sin ese vínculo seguirá siendo una declaración de postura importante, pero una prueba débil de control real. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters] [5 · NIST]

Fuentes

  1. Microsoft AI — anuncio de consulta pública — 14 de septiembre de 2026; fuente primaria sobre el estado del borrador, los plazos y el proceso de consulta.
  2. Microsoft AI — Humanist AI Code of Conduct — Texto primario de los requisitos y los límites absolutos.
  3. Reuters — borrador del código de Microsoft AI — 14 de septiembre de 2026; confirmación independiente del acontecimiento y del contexto de elaboración.
  4. Hadfield-Menell y coautores — The Off-Switch Game — Artículo original de la conferencia IJCAI 2017; modelo teórico, no una prueba de productos de Microsoft.
  5. NIST — Challenges to the Monitoring of Deployed AI Systems — Marzo de 2026; informe de investigación sobre el seguimiento de sistemas de IA después del despliegue.