«Pace the Frontier» - план главы Anthropic Дарио Амодеи, опубликованный через неделю после предупреждения исследователя Anthropic о рисках, которое взбудоражило отрасль AI. Идея в том, чтобы снизить темп наращивания возможностей передовых моделей: сектор безопасности должен успевать находить уязвимости раньше, чем модели станут ещё мощнее. TechCrunch
План трёхэтапный: встроенные независимые оценщики безопасности внутри лабораторий, координация между компаниями передового AI демократических стран и глобальная координация. Anthropic односторонне взяла на себя первый шаг и призвала правительства потребовать того же от остальных компаний передового AI.
Часть индустрии инициативу поддержала. Глава Nvidia Дженсен Хуанг выступил с критикой. Ниже - что именно предлагает Амодеи, как устроена встроенная оценка на практике, где у плана слабые места и что из этого следует для разработчиков и пользователей передовых моделей.
Что такое «Pace the Frontier» и зачем он появился
Фронтир в названии - передний край разработки: самые мощные модели, которые задают планку для всей отрасли. Логика плана простая: возможности моделей растут быстрее, чем инструменты контроля над ними, и разрыв стоит сократить. План предполагает смену приоритетов внутри лабораторий, когда часть ресурсов уходит на оценку безопасности и red-team.
«Мы должны замедлить темп, с которым мы улучшаем возможности моделей ИИ. Прогресс всё равно будет казаться быстрым, и нам нужно разумно использовать полученное время», - написал Амодеи в эссе «We Must Pace the Frontier».
В том же эссе он предложил трёхэтапный план: встроенные оценщики, координация между компаниями передового AI в демократических странах и глобальная координация. Anthropic, по его словам, односторонне обязуется выполнить первый шаг и призывает правительства потребовать от других компаний передового AI сделать то же. unite.ai
Контекст: предупреждение исследователя Anthropic
Триггером стало предупреждение исследователя Anthropic о рисках, прозвучавшее за неделю до публикации плана. Содержания этого предупреждения источники не раскрывают, поэтому разбирать конкретные аргументы не имеет смысла. Показательна сама последовательность: сначала публичное заявление о рисках внутри лаборатории, затем - план от её руководителя.
Фон шире одного эпизода. О замедлении передовых разработок в 2026 году высказались сразу несколько руководителей AI-компаний, и этот сдвиг риторики разобран отдельно: почему лидеры AI-индустрии резко сменили риторику.
Три этапа плана: от встроенных аудиторов до глобальной координации
Каждый следующий уровень сложнее предыдущего. Первый Anthropic может запустить в одиночку, второй требует договорённостей между компаниями, третий - между государствами.
Этап 1: встроенные независимые оценщики безопасности
Встроенные оценщики работают внутри AI-компаний и получают доступ, сопоставимый с доступом сотрудника. Внешние оценщики, к сравнению, работают вне компаний, которые они проверяют. Доступ уровня сотрудника позволяет наблюдать за формированием моделей прямо в процессе обучения, отслеживать решения о том, как модели создаются и развёртываются, и напрямую общаться с людьми внутри лаборатории. Anthropic планирует пригласить внешнюю ревизионную команду и оснастить её рабочими местами в офисах, пропусками и ноутбуками компании, а доступ к рабочим пространствам, инструментам и правам сделать в основном таким же, как у внутренних команд по оценке рисков. Исключения - там, где этого требуют закон или контракты, и для защиты конфиденциальной информации клиентов и партнёров. Внешние ревизоры смогут публиковать главные выводы о рисках, инцидентах, практиках и о доступе, который они получили или не получили, без редакционного контроля Anthropic; компания сохранит лишь ограниченное право править сведения, относящиеся к безопасности, юридической привилегии, коммерческой чувствительности или конфиденциальности третьих сторон. Ответственность за безопасность моделей остаётся на Anthropic: оценщики не переносят её на себя, а делают компанию более проверяемой. Встроенная оценка - новая практика, многие детали её работы ещё уточняются. unite.ai
Этап 2: координация между лабораториями демократических стран
Второй этап - общие стандарты безопасности и обмен информацией об уязвимостях между компаниями передового AI демократических стран. Амодеи призвал правительства потребовать от остальных лабораторий того же шага, который Anthropic делает сама: допустить встроенных оценщиков внутрь процессов. Без такого требования компания, открывшая доступ добровольно, оказывается в невыгодном положении по скорости выпуска моделей.
Этап 3: глобальная координация
Третий этап охватывает как можно больше стран, и это самый долгий уровень. Ограничения внутри группы государств теряют смысл, если сопоставимые модели развиваются за её пределами, а согласовать правила между странами с разными подходами к регулированию AI сложно. Конкретных механизмов этого этапа в источниках нет, поэтому обсуждать здесь пока нечего, кроме направления.
Как будут работать независимые аудиторы: доступ, инструменты и ограничения
Первый этап уже перешёл из декларации в соглашение с конкретным партнёром. Организационная часть закреплена отдельным контрактом, а механика доступа описана в эссе Амодеи.
Партнёрство с Accenture и роль Faculty
18 сентября 2026 года Anthropic объявила о сотрудничестве с Accenture в независимой оценке передовых AI-моделей. Работу возглавит Faculty, специализированное AI-подразделение Accenture: в задачи входят оценка и red-team моделей, оценки согласованности и тестирование средств защиты. Каждая из компаний ожидает вложить в это направление не менее $1 млрд в течение пяти лет. unite.ai
Партнёрство неэксклюзивное: Anthropic будет работать и с другими оценщиками, а Accenture - с другими AI-разработчиками. Anthropic
Со схемой оплаты сложнее. Устоявшейся системы финансирования независимой оценки не существует: по замыслу Anthropic деньги в долгосрочной перспективе должны идти из объединённых или государственных источников, но таких механизмов сегодня нет. Поэтому компания финансирует работу Accenture напрямую и планирует сотрудничать с разными оценщиками по разным схемам. С некоммерческими оценщиками идёт диалог о пилотировании элементов встроенной оценки за их собственный счёт. Anthropic
Если лаборатория платит аудитору, вопрос о независимости последнего остаётся открытым, и это одна из главных претензий к конструкции. Формально ревизоры подотчётны контракту, а не компании, но экономическая зависимость никуда не исчезает.
Поддержка и критика: почему у инициативы есть сторонники и противники
Аргумент сторонников: безопасность нужно развивать синхронно с возможностями, иначе тестирование всегда будет отставать на поколение. Разбор позиций Anthropic, OpenAI и других игроков, публично поддержавших курс на согласование темпов, собран в материале Anthropic и OpenAI договорились «замедлить фронтир».
Противники указывают на другое: добровольное замедление бьёт по конкурентоспособности тех, кто его соблюдает, а выигрывают те, кто не присоединился. Свобода исследований и скорость выпуска моделей тоже попадают под удар.
Позиция Дженсена Хуанга и Nvidia
Глава Nvidia Дженсен Хуанг выступил с критикой инициативы. Формулировок из его выступления источники не приводят, но сам факт возражений подтверждён. Мотивы Nvidia источники не разбирают, однако рыночная логика прозрачна: компания продаёт GPU для обучения и запуска передовых моделей, а замедление отрасли означает замедление спроса на её железо. TechCrunch
Можно ли договориться о едином определении «замедления» и кто будет следить за соблюдением
Открытый вопрос, который план не закрывает: смогут ли компании договориться о едином определении «замедления» и кто будет следить за его соблюдением. TechCrunch
Проблема в метрике. Под замедлением понимают разное: отказ от выпуска конкретной модели, снижение прироста вычислительных мощностей на обучение, замедление роста результатов на бенчмарках. Пока критерий не зафиксирован, проверить выполнение обязательств нечем, а значит, и наказать за их нарушение нельзя.
Со следящими тоже неясно. Встроенные оценщики находятся внутри компаний и получают деньги от них же, то есть конфликт интересов заложен в саму конструкцию. Международные организации не имеют принудительной силы. Правительства действуют в своих интересах и в своём темпе. На момент объявления не было даже стандартов того, к какой информации встроенные оценщики должны иметь доступ и как они должны отчитываться о находках. Anthropic
Показательный прецедент - открытое письмо более 1100 сотрудников OpenAI, Anthropic и Google с призывом контролировать темпы фронтальных разработок: документ из трёх абзацев без определений и механизмов.
Без единой метрики и механизма принуждения план рискует остаться декларацией. Координация между демократическими странами закрывает только часть задачи, а глобальный уровень упирается в геополитику.
Что это значит для разработчиков и пользователей передовых AI-моделей
Краткосрочно - почти ничего. «Pace the Frontier» остаётся эссе и набором добровольных обязательств: закона, который заставлял бы лаборатории замедлиться, нет. Anthropic уже допустила внешних оценщиков к своим процессам, остальные компании делать это не обязаны. Как это устроено у разных игроков, разобрано в материале о внутренних дебатах Anthropic по AI-безопасности.
Если встроенная оценка станет отраслевым стандартом, нагрузка на разработчиков вырастет. Внешние ревизоры с доступом уровня сотрудника означают согласования по доступам, документирование решений о выпуске модели, отдельные окна под red-team и оценку согласованности. Это время и деньги, которые не идут в обучение следующей версии. Логичное следствие - удлинение цикла выпуска фронтирных моделей и рост порога входа для небольших команд.
Пользователям стоит готовиться к более редким обновлениям топовых закрытых моделей и к более подробным правилам использования. Гарантий здесь нет: пока план не превратился в требования регуляторов, всё зависит от доброй воли лабораторий.
Для локальных LLM и открытых весов эффект скорее косвенный. Встроенная оценка предполагает физическое присутствие аудитора внутри компании и доступ к внутренним инструментам, а такой формат плохо сочетается с проектами, где веса и код выкладывают публично. Открытые модели и локальный запуск остаются способом не зависеть от политики отдельной платформы.
Практический вывод: следить за тем, появятся ли у встроенной оценки формальные стандарты доступа и отчётности и подключатся ли к ней другие лаборатории по требованию регуляторов. От этого зависит, останется инициатива публичным жестом или превратится в правила, обязательные для всей отрасли.