Перейти к содержанию
Публикация AiManual

Anthropic выпустила Opus 5.5: что изменилось, насколько модель сильнее Fable и стоит ли переходить

Anthropic выпустила Claude Opus 5.5: выходные токены подешевели до $20 за миллион, модель быстрее Opus 5 и, по заявлению компании, обходит Fable во многих бенчм

Коротко

Что будет в материале

  1. 01

    Что такое Opus 5.5 и что именно изменилось

  2. 02

    Бенчмарки Opus 5.5: где модель обходит Fable, а где сравнение некорректно

  3. 03

    Цена и скорость: сколько стоит Opus 5.5 на практике

  4. 04

    Стиль общения Opus 5.5: меньше жаргона, больше конкретики

Anthropic выпустила Opus 5.5 во вторник, 22 сентября 2026 года, и назвала её «самой производительной моделью из всех, что мы тестировали». Релиз вышел через два месяца после Opus 5, которая появилась 24 июля, и, по заявлению компании, задаёт новый уровень в программировании и интеллектуальной работе (TechCrunch).

Три ключевых изменения. Выходные токены подешевели: $20 за миллион против $25 у предыдущей версии. Модель работает быстрее, потому что на её обслуживание уходит меньше вычислений. Стиль ответов стал практичнее: реже жаргон, важная информация чаще стоит в начале сообщения.

Что не поменялось. Opus 5.5 остаётся облачной моделью Anthropic: доступ через API и продукты компании, локального запуска нет. Следующие уровни линейки, Sonnet 5.5 и Haiku 5.5, обещаны «в ближайшие недели» с аналогичными улучшениями производительности.

Что такое Opus 5.5 и что именно изменилось

Opus 5.5 - новая флагманская модель линейки Claude. Речь о развитии Opus 5, а не о новой архитектурной ветке: изменения касаются цены, скорости и поведения, платформа доступа прежняя. Обучение безопасности тоже шло по знакомой схеме, о ней ниже.

Ключевые изменения Opus 5.5 в сравнении с Opus 5

ПараметрOpus 5Opus 5.5
Цена выходных токенов$25 за миллион$20 за миллион
Другие метрики ценыбазовый уровеньснижены аналогичным образом
Скорость работыбазовый уровеньвыше за счёт меньших вычислительных затрат на обслуживание
Стиль ответовжаргон встречается чащеменьше жаргона, главное в начале сообщения
Расход токенов на задачубазовый уровеньменьше, по заявлению Anthropic
Дата релиза24 июля 202622 сентября 2026

Anthropic отдельно заявляет, что Opus 5.5 тратит меньше токенов на задачу, чем Opus 5. Для бюджета это важнее, чем цена за миллион: платят не за токены, а за закрытые задачи. Проверить утверждение можно только на своих запросах, публичных замеров расхода в источнике нет.

Другие метрики цены снизились аналогичным образом, но конкретные значения по входным токенам и чтению из кэша в источнике не приводятся. Подставлять в расчёты цифры по памяти не стоит.

Почему релиз вышел так быстро после Opus 5

Opus 5.5 - первый релиз Anthropic после того, как CEO компании Дарио Амодеи поддержал призывы замедлить развитие фронтирных возможностей ИИ, чтобы согласовать темпы прогресса в возможностях с прогрессом в области alignment. Между двумя флагманскими релизами прошло два месяца.

Anthropic подчёркивает, что для будущих моделей уже готовятся более продвинутые системы обучения и оценки, включая улучшенные системы безопасности и мониторинга. Подробностей компания не раскрывает, так что судить о них пока не по чему.

Бенчмарки Opus 5.5: где модель обходит Fable, а где сравнение некорректно

Главный тезис релиза звучит так: Opus 5.5 задаёт новый уровень производительности в программировании и интеллектуальной работе, обходит более крупную Fable во многих бенчмарках и справляется с рядом неформальных задач, которые Fable не удались. Все три формулировки принадлежат Anthropic. Независимой проверки в источнике нет, поэтому корректная рамка - заявление вендора, а не измеренный результат.

Opus 5.5 vs Fable: что говорят заявления Anthropic

В формулировке про «неформальные задачи» есть отдельная тонкость. Это качественное описание без баллов, набора тестов и методики, поэтому ни подтвердить, ни опровергнуть его по публикации нельзя. Считать это воспроизводимым бенчмарком не стоит.

Интереснее другое: Fable крупнее, а Opus 5.5 обходит её во многих тестах. Это указывает на то, что размер модели сам по себе не гарантирует преимущества, а результат определяют схема обучения и эффективность инференса. Дополнительный маркер уровня: Anthropic заявляет, что Opus 5.5 сопоставима с Mythos по возможностям в биологии и кибербезопасности.

Конкретных процентов, названий тестов и абсолютных баллов по Opus 5.5 в источнике нет. Если нужен воспроизводимый ориентир, полезно посмотреть на бенчмарки предыдущего поколения: Claude Opus 5 занял первое место в Intelligence Index от Artificial Analysis с 61 баллом против 60 у Fable 5, а разбор Frontier-Bench, GDPval-AA и ARC-AGI-3 есть в материале Claude Opus 5: бенчмарки, архитектура усилий и сравнение с Fable 5. Там же разобран механизм управления усилиями (effort) от low до max и его влияние на стоимость.

Практический способ проверить заявления самому: взять 10-20 типовых запросов своего профиля, прогнать их на Opus 5.5 и на модели, которой вы пользуетесь сейчас, и сравнить не только качество ответов, но и число токенов на задачу. Такой тест занимает пару часов и даёт больше, чем любая таблица с чужими цифрами.

Сравнение с GPT-6 Sol: почему цена за токен не равна цене за задачу

GPT-6 Sol от OpenAI стоит вдвое дешевле за токен, чем Opus 5.5. Anthropic отвечает, что Opus 5.5 расходует меньше токенов на задачу, чем Opus 5, поэтому сравнение не прямое. Там же отмечается, что GPT-6 Sol соответствует или превосходит Claude Fable 5.1 на части бенчмарков (MacRumors).

Логика простая. Итоговый счёт зависит от двух множителей: цены за токен и расхода токенов на задачу. Модель с ценой вдвое ниже может оказаться дороже в работе, если на решение уходит в разы больше шагов, повторов и рассуждений. И наоборот: дорогая за токен модель с экономным расходом выигрывает на длинных агентных цепочках.

МодельЦена за токенЧто важно для сравнения
Opus 5.5$20 за миллион выходных токеновменьше токенов на задачу, чем у Opus 5, по заявлению Anthropic
Opus 5$25 за миллион выходных токеновпредыдущая версия флагмана
GPT-6 Solвдвое дешевле за токен, чем Opus 5.5прямое сравнение некорректно из-за разного расхода токенов на задачу

Обе стороны сравнения - заявления производителей. Итоговая цифра в вашем счёте зависит от ваших промптов и длины цепочек, поэтому ориентироваться стоит на собственные логи, а не на маркетинговые таблицы.

Цена и скорость: сколько стоит Opus 5.5 на практике

Выходные токены: $20 за миллион против $25 у предыдущей версии, снижение на 20% по этой строке. Другие метрики цены уменьшились аналогичным образом, точных значений по входным токенам и кэшу в источнике нет.

Формула расчёта не менялась: стоимость задачи = (входные токены × цена входа) + (выходные токены × цена выхода). В агентных сценариях добавляются повторы: каждый шаг цикла - отдельный вызов со своим расходом.

Как считать реальную стоимость: токены на задачу важнее цены за токен

Арифметика на круглых числах. 8 000 выходных токенов на одну задачу при цене $25 за миллион - это $0,20, при $20 за миллион - $0,16. Это иллюстрация формулы, а не измерение реального расхода.

Если заявление Anthropic о меньшем расходе токенов на задачу подтвердится на ваших запросах, разрыв вырастет. Насколько именно, в источнике не сказано. Возьмите свою статистику по Opus 5: число входных и выходных токенов на типовой запрос, умножьте на новые цены. Получится оценка экономии без учёта сокращения расхода, то есть осторожный вариант.

Как считать расходы на API и как устроена формула стоимости, разбирали в материале про Anthropic Fable 5.1: дешевле, мягче к ограничениям и с упором на корпоративное использование.

Скорость работы и что она даёт в реальных сценариях

Модель быстрее за счёт общего снижения вычислительных затрат на её обслуживание. В источнике нет ни значений latency, ни tokens per second, поэтому конкретных секунд обещать не стоит.

Где ускорение чувствуется сильнее всего: интерактивный чат, где важен темп диалога; автодополнение кода, где задержка раздражает на каждом срабатывании; агентные пайплайны с десятками последовательных вызовов, где секунды складываются в минуты. Меньшие вычислительные затраты на обслуживание влияют и на пропускную способность при массовых запросах, но подтверждённых цифр по этому пункту нет.

Стиль общения Opus 5.5: меньше жаргона, больше конкретики

Anthropic заявляет два изменения в поведении модели: она реже использует жаргон и чаще выносит важную информацию в начало сообщения. Для разработчика, который читает ответ прямо в IDE или терминале, принцип «сначала главное» экономит время на вычитке: вывод виден с первых строк, а детали можно читать по необходимости.

Для клиентских текстов, документации и внутренних регламентов меньше жаргона означает меньше правок и меньше переписывания «с человеческого на понятный».

Оба изменения субъективные, и их эффект зависит от промптов. Если системный промпт задаёт другой стиль, модель будет следовать ему, а не дефолтному поведению. Сравнивать на глаз стоит на одинаковых запросах с одинаковыми настройками, иначе разница объясняется промптом, а не моделью.

Безопасность и ограничения: что нужно знать перед использованием

Anthropic заявляет, что Opus 5.5 сопоставима с Mythos по возможностям в биологии и кибербезопасности, поэтому на релиз распространяются те же меры защиты, что и на Fable. Эти меры ограничивают использование моделей для поиска эксплойтов в скомпилированных программах и для разработки узнаваемого биологического оружия, среди прочих задач.

Обучение безопасности шло в целом схожим с предшественниками путём: alignment-тестирование и предрелизная оценка внешними организациями, включая METR и Frontier Design.

«По мере роста возможностей ИИ публичная политика должна значить больше в вопросе безопасности систем, на которые полагаются люди. Такая инфраструктура строится долго, и мы начали её создавать», - говорится в блоге Anthropic.

Для практики важно одно: если ваши задачи далеко от кибербезопасности и биотемы, ограничения вряд ли вас коснутся. Если вы работаете как раз в этих областях, до старта стоит проверить свои сценарии на живых запросах. Как устроены защитные протоколы предыдущих версий и как менялись ограничения, разбирали в материале Anthropic Opus 5: сравнение с Fable 5, бенчмарки и ослабленные ограничения.

Opus 5.5, Sonnet 5.5 или Haiku 5.5: что выбрать

Когда Opus 5.5 оправдана, а когда хватит Sonnet или Haiku

Флагман имеет смысл там, где цена ошибки высока, а задача длинная:

  • сложный рефакторинг и разбор больших кодовых баз;
  • многошаговые агенты, где каждый шаг влияет на следующий;
  • задачи с длинным контекстом: аудит документации, анализ логов, юридические и медицинские тексты;
  • интеллектуальная работа, где нужна связность рассуждения на несколько страниц.

Младшие уровни линейки обычно закрывают другое:

  • простые генерации и переписывание текста;
  • классификация, извлечение данных, разметка;
  • чат-боты с узкой задачей и короткими ответами;
  • массовые операции, где важна сумма счёта, а не пиковое качество.

Без тестов на своих данных выбор остаётся гипотезой. Рабочий метод простой: собрать 10-20 типовых запросов, зафиксировать для них эталонные ответы и прогнать через доступные модели, сравнив качество и число токенов. Такой прогон обычно показывает, что часть задач прекрасно решается младшей моделью, и флагман нужен реже, чем кажется.

Что известно о Sonnet 5.5 и Haiku 5.5

Обе модели обещаны «в ближайшие недели» с аналогичными улучшениями производительности. Цены, бенчмарки, даты и характеристики на момент публикации неизвестны. Если паттерн Opus 5.5 повторится, логично ожидать снижения цены и роста скорости, но это предположение, а не факт. Разбор того, как новые модели и инфраструктурные решения меняют рынок AI, есть в материале Claude Sonnet 5 и конкуренты.

Можно ли запустить Opus 5.5 локально и какие есть альтернативы

Нет. Opus 5.5 - облачная модель Anthropic, доступная через API и продукты компании. Локальный запуск не предусмотрен, весов в открытом доступе нет.

Если нужен локальный вариант, смотреть стоит на открытые модели сопоставимого класса, но утверждать, что какая-то конкретная открытая модель равна Opus 5.5 по качеству, нельзя: таких данных нет ни в источнике, ни в независимых замерах. Требования к VRAM зависят от размера модели и квантования, поэтому подбор железа стоит начинать с оценки доступной памяти.

Итог: стоит ли переходить на Opus 5.5

Opus 5.5 дешевле Opus 5 по выходным токенам ($20 против $25), быстрее за счёт меньших вычислительных затрат и, по заявлению Anthropic, обходит более крупную Fable во многих бенчмарках. Ответы стали практичнее: меньше жаргона, главное в начале сообщения.

Ограничения тоже конкретные: это облачная модель без локального запуска, на неё распространяются защитные меры по биологии и кибербезопасности, а сравнение с GPT-6 Sol не прямое из-за разного расхода токенов на задачу.

Короткий чек-лист для решения:

  1. Есть ли у вас задачи, где решает максимум качества: сложный рефакторинг, многошаговые агенты, длинный контекст?
  2. Готовы ли вы платить $20 за миллион выходных токенов и считать бюджет по токенам на задачу, а не по цене за токен?
  3. Насколько срочно нужен результат? Если нет, разумно дождаться Sonnet 5.5 и Haiku 5.5.
  4. Затрагивают ли вас ограничения по биологии и кибербезопасности?

Если первый пункт про вас, а третий требует ответа «нужно сейчас», переход оправдан: модель дешевле и быстрее предыдущей. Если задачи типовые, посчитайте токены на задачу в Opus 5 и дождитесь анонса младших моделей линейки: для массовых операций флагман чаще всего избыточен.

Подписаться на канал