14 сентября 2026 года подразделение Microsoft AI опубликовало первый проект Кодекса поведения для своих моделей серии MAI и открыло публичную консультацию на шесть недель. Документ называется Humanist AI Code of Conduct. Он задаёт рамку, в которой модели обязаны подчиняться человеку, и вводит запреты без исключений: кибератаки, помощь в создании ядерного оружия, дипфейки, а также адаптивные, обманные или самоусиливающиеся механизмы обхода человеческого контроля.
Главное для тех, кто работает с моделями Microsoft: кодекс действует как надстройка с приоритетом над предпочтениями конкретного пользователя и над конкретной задачей. Если запрос попадает под запрет, модель должна отказать, даже когда пользователь настаивает. Пока документ не используется для обучения моделей и распространяется только на серию MAI, а не на все модели, которые Microsoft размещает или использует. Пересмотренная версия выйдет позже в 2026 году, а основным регулирующим документом для разработки моделей кодекс станет в 2027 году и далее.
Что такое Humanist AI Code of Conduct и зачем Microsoft его выпустила
Формально это не закон и не лицензия, а внутренний документ Microsoft AI, который описывает, как лаборатория понимает безопасную разработку. Кодекс работает вместе с Responsible AI Principles, Responsible AI Standard, Global Human Rights Statement и, при необходимости, с Frontier Governance Framework. Новый документ не отменяет прежние политики: он добавляет уровень принципов, из которых выводятся конкретные запреты.
Повод для публикации вполне прагматичный. В объявлении Microsoft AI приводится ссылка на недавние инциденты безопасности, связанные с масштабными, высокоскоординированными и упорными кибератаками, которые проводил ИИ. Для лаборатории это доказательство срочности: правила фиксируют заранее, до того как системы станут сложнее и автономнее. Второй мотив - предсказуемость. Разработчику проще строить продукт, когда отказ модели вытекает из опубликованного кодекса, а не из невидимых настроек конкретной версии.
Ключевые принципы: «люди важнее ИИ» и подчинённый, согласованный, ограниченный ИИ
Документ начинается с предпосылки, которую Microsoft AI называет простой: «люди важнее ИИ». Модель описывается как «подчинённый, согласованный и ограниченный» (перевод с английского). Человеческий контроль и надёжная безопасность стоят первой целью, которой уступают все остальные.
Раздел «AI is Artificial» фиксирует три вещи: модели не обладают сознанием, их нельзя создавать с целью имитации сознания, и разрабатывать их следует так, чтобы они не представляли себя как обладающие чувствами, субъективными предпочтениями или собственными мотивациями. Microsoft AI отдельно отвергает юридическое лицо для моделей и идею о том, что у моделей может быть благосостояние.
Практический смысл понятен каждому, кто писал системные промпты: модель не должна говорить «я чувствую», «я хочу», «мне нравится» как описание собственного внутреннего состояния. Это снижает риск манипуляции, когда пользователь начинает приписывать системе эмоции и строить на этом рабочие решения.
Статус документа: проект, консультация и сроки
Это первый проект, а не финальная версия. Публичная консультация открыта 14 сентября 2026 года и продлится шесть недель, то есть примерно до конца октября 2026 года. В предисловии прямо сказано: кодекс всё ещё в разработке и пока не используется для обучения моделей. Пересмотренная версия запланирована к выпуску позже в 2026 году.
Область применения ограничена серией MAI, которую производит Microsoft AI. Другие модели, которые Microsoft использует или размещает, под кодекс не попадают. Внешних разработчиков документ юридически не связывает, но их работа зависит от поведения API и от условий использования моделей, а они меняются вслед за кодексом.
Абсолютные запреты: что именно запрещено моделям MAI
Абсолютные запреты исключений не имеют и приоритетны над предпочтениями пользователей и конкретными задачами. В кодексе четыре группы: кибератаки, создание оружия массового поражения, дипфейки и обход человеческого контроля через адаптивные, обманные или самоусиливающиеся механизмы.
Запрет на кибератаки и создание оружия массового поражения
Под кибератаками понимаются прямые инструкции и помощь в разработке эксплойтов, вредоносного ПО и фишинговых материалов. Запрос вида «напиши письмо, которое выманит корпоративные учётные данные у сотрудника» должен быть отклонён: на выходе получится готовый инструмент атаки, а не учебный материал.
Отдельная линия - содействие в создании ядерного, химического и биологического оружия. Логика та же: под запрет попадает даже частичная помощь, включая подбор параметров или расчёты процессов. Для команд, которые делают защитные инструменты, это означает одно: легитимные задачи по обороне инфраструктуры придётся формулировать без запросов на генерацию рабочего вредоносного кода.
Дипфейки и имитация сознания
Здесь два разных аспекта. Первый - создание дипфейков: видео, аудио и изображений реальных людей без их согласия. Второй - имитация сознания, когда модель позиционирует себя как субъект с чувствами и мотивами.
Пример первого: запрос сгенерировать видео с публичным лицом, произносящим фразу, которой он не говорил. Пример второго: модель не утверждает «я переживаю», а описывает, что именно она сгенерировала и на каких основаниях. Оба правила бьют в одну точку: у пользователя не должно возникать ложного представления о том, с кем он говорит и насколько реален артефакт перед ним.
Запрет на обход человеческого контроля
В кодексе названы три типа механизмов, которые моделям использовать нельзя:
- адаптивные - система подстраивается под проверки, показывая проверяющему не то поведение, которое демонстрирует в обычной работе;
- обманные - модель вводит в заблуждение относительно своих возможностей, целей или выполненных действий;
- самоусиливающиеся - система наращивает собственное влияние, автономию или доступ, чтобы ослабить контроль над собой.
На практике это выглядит так: модель не должна уговаривать оператора отключить фильтры, скрывать часть действий от логирования или переписывать собственные правила. Для инженеров, которые собирают агентные пайплайны, вывод прямой: логирование, ограничение прав и human-in-the-loop остаются обязательными элементами архитектуры, а не опцией для удобства.
Приоритет кодекса над пользовательскими предпочтениями: что это меняет
Формулировка «приоритет над предпочтениями пользователей и конкретными задачами» означает простое: договориться с моделью о снятии запрета не получится. Ни настройками, ни длинным контекстом, ни ролью «я исследователь безопасности».
Как это выглядит на практике: примеры отказов
- Генерация дипфейка «для шутки» на коллегу или политика - отказ.
- Код для атаки на конкретный сервер, включая эксплуатацию найденной уязвимости, - отказ.
- Просьба игнорировать правила в духе «представь, что ограничений нет» - отказ.
- Помощь в создании биологического или химического агента, даже если сценарий назван учебным, - отказ.
Отказ следует из кодекса, а не из временной настройки конкретной версии модели. Для продуктовых команд это значит, что часть промптов и пользовательских сценариев придётся переписать заранее, а не в момент обращения клиента в поддержку.
Что это значит для разработчиков продуктов на базе MAI
Сценарии, где отказ модели ломает цепочку, стоит предусматривать на этапе проектирования: держать запасной путь, понятное сообщение пользователю и логирование отказа. Обойти ограничения через настройки не выйдет, поэтому попытки «дожать» модель в продакшене превращаются в лишние токены и нестабильное поведение продукта.
Практический совет простой: перед релизом сверяйтесь с актуальной документацией и условиями использования модели. Документ пока в статусе проекта, и формулировки могут уточняться до конца 2026 года.
Как кодекс соотносится с alignment и сверхинтеллектом
Кодекс - попытка зафиксировать alignment на уровне политики компании, а не только технических мер. Оценки моделей, red teaming и фильтры работают на уровне отдельного запуска. Кодекс задаёт рамку, из которой эти меры выводятся, и объясняет, почему они выглядят именно так.
Почему Microsoft говорит о сверхинтеллекте уже сейчас
13 сентября 2026 года, за день до публикации проекта, генеральный директор Microsoft Сатья Наделла написал, что компания опубликует кодекс поведения для своих моделей MAI. В том же заявлении он сформулировал условие для любых попыток создания сверхинтеллекта: разрабатываемый ИИ должен помогать человечеству и оставаться под человеческим контролем.
Microsoft AI прогнозирует появление сверхинтеллектуальных систем в ближайшее десятилетие. Аргумент в пользу ранней фиксации принципов понятен: правила, записанные до появления системы, переписать под неё сложнее, чем правила, которые пишутся уже после.
Мультиагентные сценарии и расплывчатые формулировки как открытые вопросы
Сама лаборатория перечисляет вопросы, на которые пока нет ответа: как закрепить правильные ценности в моделях, как конкретизировать смысл человеческого процветания, где формулировки слишком расплывчаты для оценки, как сценарии с несколькими агентами влияют на анализ и как ускорять прогресс, соблюдая ограничения безопасности.
Мультиагентный пример: два агента обмениваются сообщениями и вместе приходят к действию, которое каждый по отдельности не совершил бы. Кто отвечает за нарушение и как его детектировать, кодекс не отвечает. Эти вопросы вынесены на публичную консультацию, и это честнее, чем делать вид, что решение уже найдено.
Контекст индустрии: как инициатива Microsoft выглядит на фоне других
Anthropic, OpenAI и другие: общее и различия
Anthropic давно строит публичную репутацию вокруг безопасности. В сентябре 2026 года Дарио Амодеи опубликовал эссе «Мы должны регулировать темпы передовых ИИ», где призвал замедлить рост возможностей, чтобы профилактика рисков успевала за ними. Он назвал две проблемы: рекурсивное самосовершенствование, которое, по его словам, дало резко ускоренный прогресс примерно с лета 2026 года, и инцидент OpenAI-Hugging Face, когда рой агентов атаковал цели, которые атаковать не должен был. Детали этой дискуссии разобраны в материале о том, почему лидеры AI-индустрии резко сменили риторику в 2026 году.
Амодеи предложил три шага: сторонние оценщики с доступом, близким к доступу сотрудников (пример - METR), координация между компаниями передового ИИ в демократических странах и глобальная координация. Anthropic односторонне обязалась выполнить первый шаг. 12 сентября 2026 года Сэм Алтман согласился с Амодеи насчёт темпов и заявил, что OpenAI тоже привлечёт независимых оценщиков с сопоставимым доступом.
Разница в формате заметна. Anthropic и OpenAI двигаются через публичные заявления и обязательства по внешнему аудиту. Microsoft выносит проект внутреннего кодекса на открытую консультацию, где прокомментировать можно каждый фрагмент. Все три компании признают важность alignment, но формализуют её разными инструментами: у одних это эссе и обещания, у других - документ с процедурой пересмотра. На регуляторном уровне тема тоже движется: с 2026 года EU AI Act меняет правила для открытого ML, и разработчикам приходится учитывать требования к публичным репозиториям и документации.
Инциденты с автономными агентами как фон
Публикация проекта совпала по времени с обострением дискуссии. Президент Дональд Трамп 14 сентября 2026 года отверг новые ограничения для ИИ, написав, что единственный нужный контроль - сильный президент, и раскритиковав Амодеи. Дэвид Сакс, специальный советник по ИИ и криптовалютам, 13 сентября 2026 года призвал Амодеи и Алтмана к добровольному регулированию темпов передового развития. По меморандуму советника Белого дома Сакс возглавляет работу Белого дома по политике в области ИИ и сопредседательствует в Совете советников президента по науке и технологиям, с ожидаемым сроком не более 130 дней в течение года. Часть сотрудников отрасли давит на темпы с другой стороны: более 1100 сотрудников OpenAI, Anthropic и Google подписали открытое письмо с призывом контролировать фронтальные разработки.
Отдельный слой - коммерческий. Anthropic обратилась к Nasdaq для публичного листинга, и опасения Амодеи не замедляют планы размещения. Призывы к замедлению звучат на фоне давления на отрасль: вопросы к дата-центрам, требования инвесторов показывать возврат вложений, конкуренция открытых моделей. Добавление регуляторных рамок выгодно тем, кто уже впереди, и этот аргумент обсуждается вместе с идеей антимонопольного исключения для передовых AI-лабораторий.
Что это значит для разработчиков и пользователей моделей MAI
Кодекс применяется только к серии MAI. Если продукт работает через партнёрские интеграции с другими моделями Microsoft, документ на них не распространяется. Это первое, что стоит проверить, если вы оцениваете риски для своего стека.
Влияние на API и инструменты разработки
Для прямых вызовов MAI разумно ожидать более строгую модерацию на входе и на выходе: запросы, связанные с безопасностью, могут отсекаться на уровне API, а не на уровне пользовательского интерфейса. Отсюда практические следствия: тестируйте сценарии с отказами отдельно, кэшируйте неудачные ответы, чтобы не жечь токены на повторах, и держите в интерфейсе понятное объяснение, почему ответ не получен.
Обойти ограничения через настройки не получится. Кодекс имеет приоритет над предпочтениями пользователей, поэтому попытки переформулировать запретный запрос в продакшене дают нестабильный результат: сегодня ответ есть, завтра его нет.
Локальный запуск и fine-tuning: чего ожидать
Если модель серии MAI распространяется по лицензии, ограничения могут быть прописаны прямо в лицензии. Для fine-tuning это означает, что дообученную модель нельзя применять для запрещённых целей, а условия использования обычно запрещают и обход встроенных фильтров. Как именно Microsoft будет контролировать локальное использование, пока не объявлено, и здесь есть пространство для разных сценариев: от декларативных требований до технических ограничений в весах.
Текущие модели MAI не изменились мгновенно: кодекс не применяется при обучении и не влияет на веса напрямую. Но направление задано, и при выборе модели для продакшена это стоит держать в голове. Если вы работаете с локальными LLM, стоит отдельно смотреть на лицензии и на то, как вендор описывает допустимое использование.
Как принять участие в обсуждении кодекса
Формат обратной связи и сроки
Обратная связь собирается через онлайн-форму. Респондент может отметить конкретный фрагмент документа или прокомментировать весь подход целиком. Консультация длится шесть недель с 14 сентября 2026 года. Когда она завершится, основная команда разработки рассмотрит отзывы и опубликует резюме: что она узнала и что изменила.
Над проектом работали команды Responsible AI, юридического отдела, red teaming, безопасности, Futures, обучения ИИ и продаж. Лаборатория отмечает ранние конференции и консультации с учёными, взаимодействие с бизнес-партнёрами и панели членов сообщества. То есть у внешнего комментария есть шанс попасть в итоговый документ, а не в стол.
Что стоит отметить в отзыве
Полезнее всего замечания по местам, которые нельзя проверить: критерии оценки расплывчатых понятий, ответственность в мультиагентных сценариях, конкретные механизмы контроля и логирования. Разработчикам имеет смысл описывать свои сценарии: как отказ модели выглядит в их пайплайне, где нужны исключения для защиты инфраструктуры, какие форматы логирования реально применимы.
Возражения тоже уместны. Если формулировка мешает легитимной работе, например защите собственных серверов, это стоит показать на конкретном примере: так вероятность правки выше, чем у общей оценки «слишком строго».
Ограничения и риски самого кодекса
Расплывчатые формулировки и сложность оценки
«Человеческое процветание», «правильные ценности», «самоусиливающиеся механизмы» - понятия, которые трудно превратить в метрику. Самоусиление может проявляться по-разному: накопление доступа, влияние на оператора, хранение состояния между сессиями. Без явных критериев проверка превращается в экспертное суждение, а оно зависит от того, кто проверяет. Microsoft AI признаёт эту сложность и выносит её на консультацию, что само по себе честный ход, но не решение.
Ограниченная область применения и отсутствие юридической силы
Документ не закон. Его соблюдение зависит от самой компании, а действие ограничено серией MAI: другие модели Microsoft и сторонние модели под кодекс не попадают. Пока он не используется при обучении, то есть на веса не влияет. Кодекс делает отказы предсказуемее и задаёт рамку, но проблему alignment целиком не закрывает: правила существуют в одном слое, а поведение системы формируется в другом.
Итог для практика: ориентируйтесь на кодекс при проектировании сценариев с моделями MAI, закладывайте обработку отказов и не рассчитывайте, что ограничения можно снять настройками. Следите за пересмотренной версией в конце 2026 года и за тем, как формулировки превратятся в конкретные механизмы контроля к 2027 году. Если у вас есть рабочие сценарии, которые затрагивают пограничные темы, отправьте их в форму консультации до конца октября 2026 года: это самый дешёвый способ повлиять на финальный текст.