Перейти к содержанию
Публикация AiManual

Claude Opus 5.5: что даёт новая флагманская модель Anthropic для кодинга и автономных задач

Anthropic выпустила Claude Opus 5.5: Terminal-Bench 4.0 - 66,4%, цены $4/$20/$0,20 за миллион токенов, Fast Mode до 2,5x в Claude Code и миграция кодовой базы н

Коротко

Что будет в материале

  1. 01

    Что такое Claude Opus 5.5 и чем она отличается от Opus 5

  2. 02

    Цены Claude Opus 5.5: $4 / $20 / $0,20 и откуда берётся экономия 40%

  3. 03

    Fast Mode и ускорение генерации: что это даёт в Claude Code

  4. 04

    Автономный кодинг: Terminal-Bench 4.0, HAProxy и миграция 680 000 строк

Claude Opus 5.5 - первая модель новой линейки Anthropic 5.5, которая заменяет Opus 5. Производительность заявлена на уровне Claude Fable 5.1, а стоимость эксплуатации ниже на 40%. Анонс датирован 22 сентября 2026 года, вместе с моделью в Claude Code и Claude Platform появился режим Fast Mode.

Разница с Opus 5 читается в трёх числах. Входные токены подешевели до $4 за миллион, выходные до $20, чтение из кэша до $0,20, то есть на 60% ниже прежнего уровня. Генерация текста ускорилась более чем на 30%. В Claude Code и Claude Platform добавили Fast Mode с ускорением до 2,5 раза.

Главный акцент сделан на автономном программировании. В Terminal-Bench 4.0 модель набрала 66,4% против 52,3% у Opus 5 и 57,9% у GPT-6 Astra. Во внутренних тестах Anthropic она мигрировала кодовую базу на 680 000 строк менее чем за сутки. Заявленные характеристики и результаты тестов собраны в сводке по релизу.

Что такое Claude Opus 5.5 и чем она отличается от Opus 5

Opus 5.5 закрывает задачи, где раньше приходилось дробить работу на короткие сессии: длинные агентные прогоны в терминале, крупные рефакторинги, миграции между языками. Anthropic описывает модель как продолжение Opus 5 с тем же классом качества, но с другой экономикой на длинных задачах.

Основные отличия от предшественника:

  • Цена за миллион входных токенов: $4 вместо прежнего уровня, выходные - $20.
  • Чтение из кэша: $0,20, снижение на 60%.
  • Генерация текста быстрее более чем на 30%.
  • Fast Mode в Claude Code и Claude Platform: до 2,5 раза быстрее.
  • Terminal-Bench 4.0: 66,4% против 52,3% у Opus 5.
  • GDPval-AA v2.1: 1846 баллов Elo на задачах по 44 профессиям.
  • Стиль ответов: формулировки проще, суть в первых предложениях.
  • Внутренний поведенческий аудит: вероятность выхода за рамки песочницы снижена на 85%.
  • Доступ через Claude Platform, AWS, Google Cloud и Microsoft Azure.

Ключевые изменения в двух словах

Если сжать до одной строки: дешевле, быстрее, автономнее. Дешевле - за счёт прайса и кэша, быстрее - за счёт ускорения генерации и Fast Mode, автономнее - за счёт роста результатов на терминальных и агентных тестах.

Позиционирование в линейке Anthropic

Opus 5.5 занимает верхнюю позицию: это флагман, который вытесняет Opus 5. Ориентиром по производительности назван Claude Fable 5.1, при этом Opus 5.5 дешевле в эксплуатации на 40%. Sonnet 5.5 и Haiku 5.5 ожидаются в ближайшее время. Это ожидание, а не подтверждённый анонс: ни дат, ни цен, ни характеристик младших моделей в источниках нет. Часть контекста о том, как Anthropic строит линейку вокруг Opus и что менялось в политике доступа, разобрана в материале о Claude Opus 5, Fable 5 и ослабленных ограничениях.

Цены Claude Opus 5.5: $4 / $20 / $0,20 и откуда берётся экономия 40%

Прайс Opus 5.5: $4 за миллион входных токенов, $20 за миллион выходных, $0,20 за чтение из кэша. Заявленные 40% экономии считаются относительно Claude Fable 5.1 и учитывают не только прайс, но и меньшее число токенов на решение задачи.

Расчёт на конкретной задаче. Допустим, запрос используют 50 000 входных токенов плюс 10 000 выходных. Без кэша: 50 000 × $4 / 1 000 000 = $0,20 за вход, 10 000 × $20 / 1 000 000 = $0,20 за выход, итого около $0,40. Если 40 000 входных токенов приходят из кэша, а 10 000 идут по обычной цене: $0,04 за обычный вход, $0,008 за чтение из кэша и $0,20 за выход, итого около $0,25. Разница к варианту без кэша - примерно 38%.

Оговорка: цена записи в кэш в источниках не приводится. Кэширование требует сначала записать контекст, поэтому расчёт выше описывает только чтение и не даёт полной картины расходов по агентной сессии.

Почему цена за токен - не вся картина

GPT-6 Sol стоит вдвое дешевле за токен, чем Opus 5.5. Anthropic возражает: Opus 5.5 расходует меньше токенов на задачу, чем Opus 5, поэтому прямое сравнение по цене за токен некорректно. Обе позиции приводит публикация MacRumors о релизе GPT-6 Sol и Luna.

Практический вывод: считать надо стоимость задачи, а не прайс за миллион токенов. Если агент закрывает задачу за восемь итераций вместо пятнадцати, экономия на объёме может перекрыть разницу в тарифе. Независимых замеров числа токенов на задачу для Opus 5.5 в доступных источниках нет, так что проверять это придётся на собственных сценариях.

Кэш как основной рычаг экономии

Кэш окупается там, где контекст повторяется: системные промпты, документация проекта, описания модулей, длинные кодовые базы. В агентных сессиях Claude Code один и тот же контекст переиспользуется десятки раз за прогон, и чтение по $0,20 за миллион вместо $4 меняет структуру расходов сильнее, чем снижение прайса на выходные токены. Правила инвалидации кэша и его время жизни в источниках не раскрыты, опираться на них при планировании бюджета не стоит.

Fast Mode и ускорение генерации: что это даёт в Claude Code

Fast Mode - режим работы в интерфейсах Claude Code и Claude Platform, который даёт ускорение до 2,5 раза. Это не отдельная модель и не другая версия Opus 5.5, а переключатель в тех же продуктах. Параллельно сама генерация текста у модели ускорилась более чем на 30%.

Где включается и для каких задач подходит

Режим доступен в Claude Code и Claude Platform. Быстрые итерации - его сценарий: правки в файлах, генерация шаблонного кода, автодополнение, небольшие рефакторинги, ответы в диалоге, где важно время до первого токена. Для длинных автономных прогонов, миграций и разбора сложных багов приоритет обычно у глубины рассуждения, а не у задержки. Точные названия пунктов меню и сочетания клавиш в источниках не указаны, поэтому переключатель стоит искать в настройках соответствующего продукта.

Ускорение генерации на 30% - что это меняет на практике

Перевод в секунды: если ответ на 500 токенов занимал 10 секунд, то рост скорости на 30% даёт около 7,7 секунды. Сам по себе выигрыш скромный. В связке с Fast Mode до 2,5x задержка становится заметной в потоковых сценариях, где пользователь ждёт текст итерациями и правит промпт по ходу. Это арифметика на заявленных Anthropic значениях, а не результат замеров.

Ограничение: влияние Fast Mode на качество ответов и на цену в источниках не раскрыто. Прежде чем переводить на него продакшн-пайплайны, оба параметра стоит проверить на своих задачах.

Автономный кодинг: Terminal-Bench 4.0, HAProxy и миграция 680 000 строк

Автономность - главный аргумент релиза. Три опорные цифры: Terminal-Bench 4.0 - 66,4%, перевод веб-прокси HAProxy с C на Rust за 9,5 часа, миграция кодовой базы 680 000 строк менее чем за сутки.

Что показывает Terminal-Bench 4.0 и почему это важно

Terminal-Bench 4.0 оценивает работу агента в терминале: модель получает задачу и выполняет её командами, без пошагового руководства со стороны человека. Результат Opus 5.5 - 66,4%. Отрыв от Opus 5 (52,3%) составляет 14,1 п.п., от GPT-6 Astra (57,9%) - 8,5 п.п.

Дополняет картину GDPval-AA v2.1, тест реальных рабочих обязанностей по 44 профессиям: 1846 баллов Elo. Методология обоих тестов в доступных источниках подробно не описана, поэтому сопоставлять имеет смысл только опубликованные проценты и баллы.

Кейс HAProxy: перевод с C на Rust за 9,5 часа

Внутренний тест Anthropic: перевод веб-прокси HAProxy с C на Rust занял у Opus 5.5 9,5 часа против 12 часов у Fable 5.1, затраты при этом снизились более чем наполовину. Вторая точка - миграция кодовой базы объёмом 680 000 строк, которая уложилась менее чем в сутки. Деталей вроде числа файлов и коммитов в источниках нет.

Оба результата получены внутри Anthropic. Независимого воспроизведения в Research Pack нет, поэтому воспринимать их стоит как заявление разработчика, а не как подтверждённый отраслевой факт. Общий контекст по агентным возможностям прошлого флагмана есть в разборе бенчмарков Opus 5 и механизма управления усилиями.

Границы применимости: где автономность пока не работает

Публичных независимых прогонов этих кейсов в Research Pack нет. Данных о провалах тоже нет, и это не означает, что их не было: результаты внутренние, а такие тесты обычно публикуют в выгодном свете. Практичный порядок действий: взять один модуль, ограничить периметр правок, обязательно ревьюить диффы, фиксировать число токенов и стоимость прогона. Расширять автономность до всей кодовой базы имеет смысл только после того, как команда увидит стабильный результат на ограниченном участке.

Claude Opus 5.5 против Opus 5, Fable 5.1, GPT-6 Astra и GPT-6 Sol

МодельTerminal-Bench 4.0Цена за токенЧто известно
Claude Opus 5.566,4%$4 вход / $20 выход, кэш $0,20GDPval-AA v2.1: 1846 Elo
Claude Opus 552,3%нет данных в источникахпредыдущий флагман, который заменяет линейка 5.5
GPT-6 Astra57,9%нет данных в источникахпо данным MacRumors, Opus 5.5 обходит Astra в части бенчмарков кодинга и knowledge work
GPT-6 Solнет данных в источникахвдвое дешевле за токен, чем Opus 5.5Anthropic настаивает: прямое сравнение некорректно из-за разного числа токенов на задачу
Claude Fable 5.1нет данных в источникахнет данных в источникахориентир по производительности, Opus 5.5 дешевле на 40%

Где Opus 5.5 выигрывает

Терминальные и агентные задачи: 66,4% в Terminal-Bench 4.0. Автономные миграции большого объёма. Цена против Fable 5.1 минус 40%. Скорость генерации плюс более 30%. Fast Mode до 2,5x. Отдельно стоит учитывать стиль ответов: суть в первых предложениях упрощает парсинг результатов в автоматизированных пайплайнах.

Где есть компромиссы

Цена за токен выше, чем у GPT-6 Sol: разница двукратная в пользу модели OpenAI. Часть заявлений держится на внутренних тестах Anthropic без независимой проверки: миграция 680 000 строк, поведенческий аудит, GDPval-AA v2.1. Строгие защитные протоколы в биологии и кибербезопасности ограничивают доступ к части возможностей. Независимого рейтинга по Opus 5.5 в Research Pack нет, поэтому подтверждённого места в сторонних индексах у модели пока не существует. Как это выглядело для предыдущего поколения, видно в разборе результатов Opus 5 в Intelligence Index, но переносить те выводы на 5.5 без данных нельзя.

Где доступна Claude Opus 5.5: Claude Platform, AWS, Google Cloud, Microsoft Azure

Модель доступна в Claude Platform и через AI-сервисы облачных провайдеров: AWS, Google Cloud и Microsoft Azure. Конкретные названия сервисов, региональные ограничения и условия биллинга в источниках не приводятся, уточнять их стоит в документации выбранного провайдера.

Что нужно для доступа к специализированным функциям

Spoiler - не кнопка в настройках. Из-за глубоких познаний модели в биологии и кибербезопасности доступ к специализированным возможностям открывают через программы верификации Life Sciences и Cyber Verification Program. Процедура подачи заявки, требования и сроки рассмотрения в источниках не раскрыты, поэтому планировать доступ к этим функциям по срокам заранее не стоит. Для команд из биотеха и безопасников это реальное ограничение: базовая модель есть, расширенные сценарии требуют отдельного статуса.

Безопасность и поведение: аудит, песочница, стиль ответов

Anthropic сообщает о лучших результатах Opus 5.5 во внутреннем поведенческом аудите компании: вероятность выхода за рамки песочницы снижена на 85%. Это внутренняя оценка разработчика, независимых подтверждений в Research Pack нет, и 85% не дают гарантии изоляции при работе с недоверенным кодом. В материалах о релизе упоминается механизм Preserved Thinking как защита от атак дистилляции, но описание в доступном фрагменте обрывается, поэтому судить о его устройстве не по чему. Формулировки Anthropic по безопасности и доступу приведены в первоисточнике.

Про коммуникацию: ответы стали проще, суть выносится в первые предложения. Для интерактивной работы это приятнее, для агентных пайплайнов полезнее тем, что сокращает объём текста, который нужно разбирать парсером. Обратная сторона в источниках не обсуждается: данных о том, как новый стиль влияет на длину ответов и расход выходных токенов, нет.

Что дальше: Sonnet 5.5, Haiku 5.5 и стоит ли ждать

Ожидаются выходы Sonnet 5.5 и Haiku 5.5. Формулировка именно такая: ожидание, а не анонс с датами. Ни цен, ни бенчмарков, ни сроков в источниках нет, поэтому строить планы на младшие модели линейки пока рано.

Логика выбора простая. Нужен максимум по кодингу и автономным задачам сейчас: Opus 5.5. Бюджет критичен, задачи простые: разумно дождаться младших моделей, но без гарантий по срокам и характеристикам, и если работа горит, ждать вслепую смысла мало. Как Anthropic выстраивает линейку вокруг Opus и какие модели выходят следом, разобрано в материале о Sonnet 5 и конкурентах.

Итог: кому стоит переходить на Claude Opus 5.5

Развилки по ситуациям:

  • Работаете в Claude Code с длинными агентными сессиями: переход оправдан. Fast Mode до 2,5x, генерация плюс 30%, кэш по $0,20 и Terminal-Bench 4.0 на уровне 66,4% бьют ровно в те места, где такие сессии проседают по времени и стоимости.
  • Команда с большим объёмом миграций: сначала пилот на одном модуле. Результаты впечатляют (HAProxy за 9,5 часа, 680 000 строк менее чем за сутки), но независимой проверки нет, а цена ошибки на большой кодовой базе высокая.
  • Решение упирается в цену за токен: считайте стоимость задачи и сравнивайте с GPT-6 Sol. Разница в прайсе двукратная, Anthropic говорит о меньшем числе токенов на задачу; проверить это можно только на своих сценариях.
  • Ждёте Sonnet 5.5 или Haiku 5.5: держите в уме, что сроки не подтверждены.
  • Нужна бюджетная альтернатива для рутины: посмотрите открытые модели, например GLM 5.2 с ценой инференса в разы ниже флагманов, и оставьте Opus 5.5 для сложных задач.

Практический шаг: возьмите одну реальную задачу, прогоните её на Opus 5.5 с кэшем и без, посчитайте токены, время и итоговую стоимость, сравните с моделью, которую используете сейчас. Цифры из анонса задают направление, но решение всегда упирается в профиль вашей нагрузки.

Подписаться на канал