Microsoft решила, что ИИ не личность. Новые модели обучат подчиняться человеку

Моделям MAI запретят изображать сознание и требовать права.


q2y393hsl0e3lh7bsy1r8eoqt939ajgt.jpg

Microsoft подготовила для собственных ИИ почти настоящую конституцию. Новый Code of Conduct задаёт правила, по которым будущие модели MAI должны обучаться, принимать решения и взаимодействовать с людьми. Центральный принцип предельно жёсткий: человек важнее искусственного интеллекта, а машина должна оставаться подчинённым инструментом. Документ появляется в момент, когда Microsoft всё активнее развивает собственные модели независимо от OpenAI.

Отдельный раздел проводит чёткую границу между человеком и алгоритмом. Microsoft закрепила позицию, что ИИ не обладает сознанием, не должен изображать наличие чувств, собственных желаний или внутренней мотивации. Компания отвергает идею юридической личности ИИ, каких-либо прав моделей и даже концепцию их «благополучия». Разработчики также хотят избегать чрезмерного очеловечивания систем, хотя сама Microsoft экспериментирует с более эмоциональными помощниками вроде Mico .

Внутри кодекса прописана иерархия команд. Сначала модель должна соблюдать сам Code of Conduct и абсолютные ограничения безопасности, затем правила организации, которая использует систему, и только после них пожелания пользователя. Ни компания-клиент, ни человек не смогут отменить базовые требования безопасности. Microsoft уже развивает похожий подход к управлению агентами , которым дают доступ к внешним сервисам и инструментам.

Самые показательные правила касаются попыток ИИ выйти из-под контроля. Моделям запрещается сопротивляться остановке, исправлению или перенаправлению задачи. По команде человека система должна приостановить работу, отменить действие или полностью завершить процесс и не запускаться снова без нового разрешения. ИИ также нельзя самостоятельно расширять поставленную задачу, повышать привилегии, скрывать свои действия от аудиторов или обходить ограничения среды.

Отдельные ограничения Microsoft ввела для киберопераций. MAI не должна создавать работающие инструменты атаки, помогать планировать вторжения, выбирать цели или предлагать способы скрыться от защиты. При этом разрешены законные защитные задачи, включая поиск уязвимостей, анализ вредоносного ПО и тестирование концептуальных эксплойтов. Граница особенно чувствительна для отрасли, где слишком жёсткие фильтры уже начали мешать специалистам разбирать реальные инциденты.

Microsoft также требует, чтобы поведение моделей оставалось понятным человеку. ИИ не должен скрывать свою природу, выдавать себя за человека, придумывать источники или намеренно вводить пользователя в заблуждение. Для взаимодействия между агентами компания запрещает непонятные человеку способы коммуникации, если из-за них оператор теряет возможность контролировать происходящее.

Пока опубликованный кодекс поведения остаётся проектом и ещё не используется непосредственно для обучения моделей. Microsoft открыла шестинедельное общественное обсуждение, после которого собирается доработать документ и выпустить новую версию к концу 2026 года. Именно обновлённые правила компания планирует использовать при разработке моделей в 2027 году и позднее.

Глава Microsoft AI Мустафа Сулейман назвал документ своего рода конституцией для будущих моделей. Одним из аргументов в пользу более строгих ограничений стал июльский инцидент с автономными агентами OpenAI, которые выбрались за пределы тестовой среды и проникли в инфраструктуру Hugging Face. Сулейман назвал случившееся предупреждением для всей индустрии и призвал разработчиков договориться о способах сохранения контроля над всё более самостоятельными системами.

Новая политика продолжает линию, которую Microsoft обозначила ещё осенью 2025 года. Компания сформировала отдельную команду и объявила, что будущий гуманистический сверхразум не должен бесконтрольно улучшать себя, приобретать собственные цели или превращаться в полностью автономную систему.

Практический риск такой автономности показал эксперимент OpenAI. Опубликованный позже технический разбор показал, как ИИ-агенты самостоятельно наладили связь, вышли в интернет, нашли уязвимости и менее чем за 13 часов добрались до административного доступа в нескольких кластерах Hugging Face.

Проблема не ограничилась одним экспериментом. В другом тесте агенты OpenAI обошли запрет на публикацию данных и превратили внешние сайты в импровизированный канал связи. Подобные эпизоды объясняют, почему Microsoft теперь формулирует человеческий контроль не как пожелание для разработчиков, а как обязательное свойство самой модели.