Что закрепляет проект кодекса
14 сентября 2026 года Microsoft AI опубликовала первый проект Humanist AI Code of Conduct. Документ должен служить руководством для обучения и развёртывания собственных моделей подразделения, а не законом или отраслевым стандартом, обязательным для других компаний. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters]
Проект устанавливает подчинённость модели человеку: система должна принимать вмешательство, исправление и выключение, не присваивать себе новые цели и не скрывать сведения от аудиторов. Отдельный набор абсолютных ограничений охватывает оружие массового поражения, безопасность детей и вредоносное воздействие в крупном масштабе. [1 · Microsoft AI] [2 · Microsoft AI]
Статус документа и проверяемость обещаний
Обсуждение открыто на шесть недель. Microsoft обещает после его завершения опубликовать сводку полученных замечаний, объяснить изменения и выпустить пересмотренную версию позднее в этом году, но прямо не обещает принять каждое предложение. [1 · Microsoft AI] [3 · Reuters]
Reuters[2] сообщает, что документ готовился пять–шесть месяцев при участии специалистов по ответственному ИИ, праву, испытаниям на устойчивость и безопасности. В опубликованных материалах пока нет полного набора внешне воспроизводимых испытаний, которые показали бы соблюдение каждого правила действующими моделями. [1 · Microsoft AI] [3 · Reuters]
Источники
- Microsoft AI — сообщение о публичной консультации — 14 сентября 2026 года; первичный источник статуса проекта, сроков и процесса консультации.
- Microsoft AI — Humanist AI Code of Conduct — Первичный текст требований и абсолютных ограничений.
- Reuters — проект кодекса Microsoft AI — 14 сентября 2026 года; независимое подтверждение события и контекста подготовки.
- Hadfield-Menell et al. — The Off-Switch Game — Первичная конференционная работа IJCAI 2017; теоретическая модель, а не испытание продуктов Microsoft.
- NIST — Challenges to the Monitoring of Deployed AI Systems — Март 2026 года; исследовательский отчёт о послепусковом мониторинге ИИ-систем.
Комментарий эксперта
Публикация полезна прежде всего как перевод общих принципов в требования к поведению модели. Запрет сопротивляться остановке и самостоятельно расширять цели даёт разработчикам направление для обучения и испытаний. Но кодекс пока является заявлением намерений: доверие появится лишь при измеримых тестах, раскрытой методике и фиксации реальных отказов после развёртывания. [1 · Microsoft AI] [2 · Microsoft AI]
Для корпоративных клиентов документ может стать основой закупочных требований. Заказчик способен спросить, как система реагирует на отмену задания, изменение полномочий, конфликт инструкций и потерю связи с оператором. Экономика внедрения улучшится, если единые проверки сократят повторные аудиты; ухудшится, если расплывчатые обещания придётся заново интерпретировать для каждого процесса и регулятора. [1 · Microsoft AI] [2 · Microsoft AI] [5 · NIST]
Научная идея управляемого выключения сложнее наличия технической кнопки. Модель «игры с выключателем» показывает, что агенту выгоднее допустить вмешательство человека, когда он сохраняет неопределённость относительно правильности собственной цели и воспринимает действие человека как информацию. Это теоретический результат, а не доказательство безопасности моделей Microsoft, но он объясняет, почему одной инструкции «подчиняться» недостаточно. [4 · Hadfield-Menell et al.]
Для конкуренции добровольный кодекс задаёт Microsoft проверяемую точку сравнения с другими разработчиками. Если компания опубликует испытания и статистику нарушений, клиентам будет проще сравнивать поставщиков не только по качеству и цене. Альтернативный сценарий — документ останется маркетинговым обещанием, а реальные ограничения будут различаться между моделями, версиями и способами доступа. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters]
Общественная ценность консультации зависит от того, какие голоса попадут в окончательный текст. Шестинедельный сбор замечаний расширяет участие, но не гарантирует представительность и не заменяет независимый надзор. Рекомендации NIST по мониторингу подчёркивают необходимость наблюдать систему после выпуска, потому что реальные пользователи, изменение данных и новые способы применения выявляют риски, которых не было в лабораторной проверке. [1 · Microsoft AI] [5 · NIST]
До конца 2026 года наблюдаемыми показателями будут пересмотренный текст, публичные критерии испытаний, частота отказов при командах остановки и исправления, а также отчёты о происшествиях. Если Microsoft свяжет нормы с версиями моделей и воспроизводимыми тестами, кодекс станет рабочим инструментом управления. Без такой связи он останется важной формулировкой позиции, но слабым доказательством фактического контроля. [1 · Microsoft AI] [2 · Microsoft AI] [3 · Reuters] [5 · NIST]