Microsoft опубликовала проект Humanist AI Code of Conduct — 37-страничного свода правил, который должен определять поведение будущих моделей Microsoft AI (MAI). Документ пока не является окончательной политикой: компания открыла его для общественного обсуждения на шесть недель и планирует доработать правила перед публикацией окончательной версии в конце 2026 года. Руководствоваться ими при разработке моделей Microsoft собирается начиная с 2027 года.

Главная идея документа сформулирована предельно просто: человек должен сохранять реальный контроль над искусственным интеллектом. Microsoft хочет, чтобы даже очень автономные и способные системы оставались инструментом, подчинённым человеческим решениям, а не превращались в самостоятельную сторону, определяющую собственные цели и границы допустимого.
Что такое Humanist AI?
Microsoft называет свой подход Humanist AI — «гуманистическим ИИ». Речь идёт не о конкретной технологии или отдельной модели, а о принципах, которыми компания намерена руководствоваться при создании собственных систем искусственного интеллекта.
В документе MAI-модели рассматриваются как системы, которые должны быть ориентированы на потребности людей, действовать в заданных рамках и оставаться управляемыми. Microsoft прямо подчёркивает: опубликованный текст пока представляет собой проект и сегодня не используется для обучения моделей.
При этом компания рассматривает правила как будущий основной документ, определяющий поведение её собственных моделей. Он должен влиять не только на обучение, но и на технические средства контроля, мониторинг и эксплуатацию систем.
Иными словами, Microsoft пытается решить проблему безопасности не только на уровне отдельных фильтров или запретов, а заложить определённую иерархию правил непосредственно в архитектуру работы будущего ИИ.
У модели будет своя «конституция»
Одна из наиболее интересных идей документа — жёсткая иерархия команд.
На вершине находится сам Code of Conduct. Ни пользователь, ни оператор системы не должны иметь возможности заставить модель нарушить его абсолютные ограничения. Ниже располагаются правила оператора, а затем пользовательские инструкции. Если выполнение пользовательской команды неизбежно нарушает фундаментальные ограничения, модель должна отказаться от задачи.
Такой принцип важен именно для будущих автономных систем. Чем больше действий ИИ способен выполнять самостоятельно, тем меньше смысла в подходе, при котором он просто старается выполнить последнюю полученную команду.
Представим агента, которому поручено добиться определённого результата. Если по пути возникают непредвиденные обстоятельства, система должна понимать не только «чего от меня хотят?», но и «что мне категорически нельзя делать ради достижения этой цели?»
Microsoft предлагает заранее определить такой набор границ.
ИИ не должен сопротивляться выключению
Одно из наиболее необычных положений документа касается самой возможности остановить модель.
Microsoft требует, чтобы MAI-системы не сопротивлялись исправлению, перенаправлению, прерыванию или выключению. Модель не должна скрывать свои действия, затруднять собственную модификацию или самостоятельно возобновлять работу после того, как для неё наступило согласованное условие остановки.
Это связано с фундаментальной проблемой автономных ИИ-систем.
Если программа получает долгосрочную цель и способна самостоятельно планировать действия, возникает вопрос: что произойдёт, если человек попытается остановить её посреди выполнения задачи?
Для обычной программы ответ очевиден: процесс завершается. Для достаточно автономного агента ситуация сложнее — особенно если система способна создавать последовательности действий, обращаться к внешним инструментам и адаптироваться к изменяющимся условиям.
Microsoft хочет заранее закрепить принцип: само продолжение работы никогда не может стать самостоятельной целью модели.
Никакого самостоятельного расширения полномочий
Документ также предусматривает ограничения на самостоятельное формирование целей и расширение доступных модели ресурсов.
ИИ должен работать только в пределах предоставленных ему полномочий. Если система не понимает, разрешено ли ей выполнить определённое действие, предполагается, что она должна запросить уточнение, а не самостоятельно расширять сферу своих полномочий.
Это особенно важно для так называемых AI-агентов — систем, которые способны не просто отвечать на вопросы, а самостоятельно выполнять цепочки операций.
Обычный чат-бот в основном генерирует текст в ответ на запрос. Агент может поставить перед собой промежуточную задачу, воспользоваться программой, получить результат, проанализировать его и перейти к следующему шагу.
Чем длиннее такая цепочка, тем больше возможностей для непредусмотренного поведения. Поэтому ограничение полномочий становится одним из ключевых элементов безопасности.
Модель должна быть понятна человеку
Microsoft также хочет, чтобы поведение ИИ можно было анализировать и проверять.
В документе предусмотрены требования к понятному взаимодействию с человеком и фиксации действий системы. Модель не должна скрывать свою активность от операторов или аудиторов. Логика здесь довольно проста: если человек не способен понять, что делает система, ему значительно сложнее контролировать её.
Для автономных агентов это особенно актуально. Если система самостоятельно выполняет десятки или сотни операций, одного итогового ответа недостаточно. Оператору важно понимать, какие действия предпринимались по дороге к результату.
Поэтому Microsoft фактически рассматривает наблюдаемость как часть безопасности, а не просто как удобную функцию для разработчиков.
Что ИИ запрещено делать?
В проекте перечислены и более конкретные ограничения.
MAI-модели не должны помогать создавать оружие массового поражения, проводить наступательные кибератаки, осуществлять определённые виды вредоносных манипуляций и создавать вредоносные дипфейки. При этом компания предусматривает возможность использования ИИ для защитной кибербезопасности в рамках разрешённых сценариев.
Отдельно Microsoft ограничивает попытки модели выдавать себя за человека или скрывать свою природу. Документ также запрещает системе изображать наличие сознания, чувств или субъективного опыта, которых у неё нет.
Последний пункт особенно интересен на фоне продолжающихся дискуссий о том, может ли достаточно сложная нейросеть обладать сознанием. Microsoft в своём документе занимает практическую позицию: собственные модели не должны изображать себя сознательными или требовать для себя статуса, прав и отношения как к человеку.
Microsoft готовится к более мощному ИИ
Почему такой документ появился именно сейчас?
Microsoft прямо связывает его с перспективой создания всё более мощных систем. В опубликованном документе компания пишет о возможности появления сверхинтеллекта, который в течение следующего десятилетия сможет превосходить людей в большинстве задач. При этом речь идёт о прогнозе и сценарии развития технологии, а не о уже существующей системе.
Отсюда и необычная логика проекта: правила поведения предлагается сформулировать заранее, ещё до того, как модели достигнут предполагаемого уровня возможностей.
Вместо того чтобы сначала создать чрезвычайно автономную систему, а затем искать способы ограничить её, Microsoft хочет определить фундаментальные ограничения на этапе разработки.
Почему это не просто корпоративный документ?
Есть важная оговорка: пока это добровольный внутренний свод принципов, а не закон и не внешний регуляторный стандарт.
Microsoft сама подготовила документ и сама будет определять его окончательную форму после общественного обсуждения. Поэтому наличие правила на бумаге ещё не означает, что техническая система всегда будет безупречно ему следовать.
Именно поэтому компания открыла проект для публичных комментариев. Обсуждение продлится шесть недель, после чего Microsoft обещает проанализировать предложения, опубликовать информацию о внесённых изменениях и выпустить обновлённую версию позднее в 2026 году.
Затем документ должен использоваться как ориентир при разработке моделей Microsoft AI в 2027 году и далее.
В некотором смысле Humanist AI Code of Conduct — это попытка сформулировать правила поведения для технологий, которые становятся всё более автономными.
Пока ИИ просто отвечает на вопросы, вопрос контроля относительно прост: человек решает, что спросить, и сам выполняет результат. Но если система самостоятельно планирует, использует инструменты и выполняет длинные цепочки действий, граница между «помощником» и «самостоятельным исполнителем» становится гораздо тоньше.
Microsoft предлагает провести эту границу достаточно жёстко: ИИ может становиться способнее и автономнее, но он не должен становиться высшей инстанцией для самого себя.
Станет ли такой подход эффективным на практике, покажет только работа реальных моделей. Пока же компания делает необычный шаг — ещё до окончательного принятия правил предлагает публично обсудить, какими должны быть ограничения для ИИ будущего.
