Перейти к содержанию
Публикация AiManual

«Pace the Frontier»: как Дарио Амодеи предлагает регулировать развитие передовых AI-моделей

Дарио Амодеи предложил «Pace the Frontier»: встроенные аудиторы с доступом уровня сотрудника, координация лабораторий демократических стран и не менее $1 млрд о

Коротко

Что будет в материале

  1. 01

    Что такое «Pace the Frontier» и зачем он появился

  2. 02

    Три этапа плана: от встроенных аудиторов до глобальной координации

  3. 03

    Как будут работать независимые аудиторы: доступ, инструменты и ограничения

  4. 04

    Поддержка и критика: почему у инициативы есть сторонники и противники

«Pace the Frontier» - план главы Anthropic Дарио Амодеи, опубликованный через неделю после предупреждения исследователя Anthropic о рисках, которое взбудоражило отрасль AI. Идея в том, чтобы снизить темп наращивания возможностей передовых моделей: сектор безопасности должен успевать находить уязвимости раньше, чем модели станут ещё мощнее. TechCrunch

План трёхэтапный: встроенные независимые оценщики безопасности внутри лабораторий, координация между компаниями передового AI демократических стран и глобальная координация. Anthropic односторонне взяла на себя первый шаг и призвала правительства потребовать того же от остальных компаний передового AI.

Часть индустрии инициативу поддержала. Глава Nvidia Дженсен Хуанг выступил с критикой. Ниже - что именно предлагает Амодеи, как устроена встроенная оценка на практике, где у плана слабые места и что из этого следует для разработчиков и пользователей передовых моделей.

Что такое «Pace the Frontier» и зачем он появился

Фронтир в названии - передний край разработки: самые мощные модели, которые задают планку для всей отрасли. Логика плана простая: возможности моделей растут быстрее, чем инструменты контроля над ними, и разрыв стоит сократить. План предполагает смену приоритетов внутри лабораторий, когда часть ресурсов уходит на оценку безопасности и red-team.

«Мы должны замедлить темп, с которым мы улучшаем возможности моделей ИИ. Прогресс всё равно будет казаться быстрым, и нам нужно разумно использовать полученное время», - написал Амодеи в эссе «We Must Pace the Frontier».

В том же эссе он предложил трёхэтапный план: встроенные оценщики, координация между компаниями передового AI в демократических странах и глобальная координация. Anthropic, по его словам, односторонне обязуется выполнить первый шаг и призывает правительства потребовать от других компаний передового AI сделать то же. unite.ai

Контекст: предупреждение исследователя Anthropic

Триггером стало предупреждение исследователя Anthropic о рисках, прозвучавшее за неделю до публикации плана. Содержания этого предупреждения источники не раскрывают, поэтому разбирать конкретные аргументы не имеет смысла. Показательна сама последовательность: сначала публичное заявление о рисках внутри лаборатории, затем - план от её руководителя.

Фон шире одного эпизода. О замедлении передовых разработок в 2026 году высказались сразу несколько руководителей AI-компаний, и этот сдвиг риторики разобран отдельно: почему лидеры AI-индустрии резко сменили риторику.

Три этапа плана: от встроенных аудиторов до глобальной координации

Каждый следующий уровень сложнее предыдущего. Первый Anthropic может запустить в одиночку, второй требует договорённостей между компаниями, третий - между государствами.

Этап 1: встроенные независимые оценщики безопасности

Встроенные оценщики работают внутри AI-компаний и получают доступ, сопоставимый с доступом сотрудника. Внешние оценщики, к сравнению, работают вне компаний, которые они проверяют. Доступ уровня сотрудника позволяет наблюдать за формированием моделей прямо в процессе обучения, отслеживать решения о том, как модели создаются и развёртываются, и напрямую общаться с людьми внутри лаборатории. Anthropic планирует пригласить внешнюю ревизионную команду и оснастить её рабочими местами в офисах, пропусками и ноутбуками компании, а доступ к рабочим пространствам, инструментам и правам сделать в основном таким же, как у внутренних команд по оценке рисков. Исключения - там, где этого требуют закон или контракты, и для защиты конфиденциальной информации клиентов и партнёров. Внешние ревизоры смогут публиковать главные выводы о рисках, инцидентах, практиках и о доступе, который они получили или не получили, без редакционного контроля Anthropic; компания сохранит лишь ограниченное право править сведения, относящиеся к безопасности, юридической привилегии, коммерческой чувствительности или конфиденциальности третьих сторон. Ответственность за безопасность моделей остаётся на Anthropic: оценщики не переносят её на себя, а делают компанию более проверяемой. Встроенная оценка - новая практика, многие детали её работы ещё уточняются. unite.ai

Этап 2: координация между лабораториями демократических стран

Второй этап - общие стандарты безопасности и обмен информацией об уязвимостях между компаниями передового AI демократических стран. Амодеи призвал правительства потребовать от остальных лабораторий того же шага, который Anthropic делает сама: допустить встроенных оценщиков внутрь процессов. Без такого требования компания, открывшая доступ добровольно, оказывается в невыгодном положении по скорости выпуска моделей.

Этап 3: глобальная координация

Третий этап охватывает как можно больше стран, и это самый долгий уровень. Ограничения внутри группы государств теряют смысл, если сопоставимые модели развиваются за её пределами, а согласовать правила между странами с разными подходами к регулированию AI сложно. Конкретных механизмов этого этапа в источниках нет, поэтому обсуждать здесь пока нечего, кроме направления.

Как будут работать независимые аудиторы: доступ, инструменты и ограничения

Первый этап уже перешёл из декларации в соглашение с конкретным партнёром. Организационная часть закреплена отдельным контрактом, а механика доступа описана в эссе Амодеи.

Партнёрство с Accenture и роль Faculty

18 сентября 2026 года Anthropic объявила о сотрудничестве с Accenture в независимой оценке передовых AI-моделей. Работу возглавит Faculty, специализированное AI-подразделение Accenture: в задачи входят оценка и red-team моделей, оценки согласованности и тестирование средств защиты. Каждая из компаний ожидает вложить в это направление не менее $1 млрд в течение пяти лет. unite.ai

Партнёрство неэксклюзивное: Anthropic будет работать и с другими оценщиками, а Accenture - с другими AI-разработчиками. Anthropic

Со схемой оплаты сложнее. Устоявшейся системы финансирования независимой оценки не существует: по замыслу Anthropic деньги в долгосрочной перспективе должны идти из объединённых или государственных источников, но таких механизмов сегодня нет. Поэтому компания финансирует работу Accenture напрямую и планирует сотрудничать с разными оценщиками по разным схемам. С некоммерческими оценщиками идёт диалог о пилотировании элементов встроенной оценки за их собственный счёт. Anthropic

Если лаборатория платит аудитору, вопрос о независимости последнего остаётся открытым, и это одна из главных претензий к конструкции. Формально ревизоры подотчётны контракту, а не компании, но экономическая зависимость никуда не исчезает.

Поддержка и критика: почему у инициативы есть сторонники и противники

Аргумент сторонников: безопасность нужно развивать синхронно с возможностями, иначе тестирование всегда будет отставать на поколение. Разбор позиций Anthropic, OpenAI и других игроков, публично поддержавших курс на согласование темпов, собран в материале Anthropic и OpenAI договорились «замедлить фронтир».

Противники указывают на другое: добровольное замедление бьёт по конкурентоспособности тех, кто его соблюдает, а выигрывают те, кто не присоединился. Свобода исследований и скорость выпуска моделей тоже попадают под удар.

Позиция Дженсена Хуанга и Nvidia

Глава Nvidia Дженсен Хуанг выступил с критикой инициативы. Формулировок из его выступления источники не приводят, но сам факт возражений подтверждён. Мотивы Nvidia источники не разбирают, однако рыночная логика прозрачна: компания продаёт GPU для обучения и запуска передовых моделей, а замедление отрасли означает замедление спроса на её железо. TechCrunch

Можно ли договориться о едином определении «замедления» и кто будет следить за соблюдением

Открытый вопрос, который план не закрывает: смогут ли компании договориться о едином определении «замедления» и кто будет следить за его соблюдением. TechCrunch

Проблема в метрике. Под замедлением понимают разное: отказ от выпуска конкретной модели, снижение прироста вычислительных мощностей на обучение, замедление роста результатов на бенчмарках. Пока критерий не зафиксирован, проверить выполнение обязательств нечем, а значит, и наказать за их нарушение нельзя.

Со следящими тоже неясно. Встроенные оценщики находятся внутри компаний и получают деньги от них же, то есть конфликт интересов заложен в саму конструкцию. Международные организации не имеют принудительной силы. Правительства действуют в своих интересах и в своём темпе. На момент объявления не было даже стандартов того, к какой информации встроенные оценщики должны иметь доступ и как они должны отчитываться о находках. Anthropic

Показательный прецедент - открытое письмо более 1100 сотрудников OpenAI, Anthropic и Google с призывом контролировать темпы фронтальных разработок: документ из трёх абзацев без определений и механизмов.

Без единой метрики и механизма принуждения план рискует остаться декларацией. Координация между демократическими странами закрывает только часть задачи, а глобальный уровень упирается в геополитику.

Что это значит для разработчиков и пользователей передовых AI-моделей

Краткосрочно - почти ничего. «Pace the Frontier» остаётся эссе и набором добровольных обязательств: закона, который заставлял бы лаборатории замедлиться, нет. Anthropic уже допустила внешних оценщиков к своим процессам, остальные компании делать это не обязаны. Как это устроено у разных игроков, разобрано в материале о внутренних дебатах Anthropic по AI-безопасности.

Если встроенная оценка станет отраслевым стандартом, нагрузка на разработчиков вырастет. Внешние ревизоры с доступом уровня сотрудника означают согласования по доступам, документирование решений о выпуске модели, отдельные окна под red-team и оценку согласованности. Это время и деньги, которые не идут в обучение следующей версии. Логичное следствие - удлинение цикла выпуска фронтирных моделей и рост порога входа для небольших команд.

Пользователям стоит готовиться к более редким обновлениям топовых закрытых моделей и к более подробным правилам использования. Гарантий здесь нет: пока план не превратился в требования регуляторов, всё зависит от доброй воли лабораторий.

Для локальных LLM и открытых весов эффект скорее косвенный. Встроенная оценка предполагает физическое присутствие аудитора внутри компании и доступ к внутренним инструментам, а такой формат плохо сочетается с проектами, где веса и код выкладывают публично. Открытые модели и локальный запуск остаются способом не зависеть от политики отдельной платформы.

Практический вывод: следить за тем, появятся ли у встроенной оценки формальные стандарты доступа и отчётности и подключатся ли к ней другие лаборатории по требованию регуляторов. От этого зависит, останется инициатива публичным жестом или превратится в правила, обязательные для всей отрасли.

Подписаться на канал