← МоделиМодель · Claude Code

Что Opus 5.5 меняет для агентских пайплайнов

Anthropic выпустила Opus 5.5: 1M контекста, цены $4/$20 за Mtok, заявленные минус 40% стоимости задачи против Opus 5, но проверять надо на своих задачах.

· 2 мин чтения

22 сентября 2026 года Anthropic выпустила Claude Opus 5.5, первую модель в семействе Claude 5.5. Окно контекста у модели 1M токенов, поддержка вызова инструментов (tools) есть. В каталоге OpenRouter модель появилась в тот же день.

Цены по API Anthropic: $4 за 1M входных токенов и $20 за 1M выходных, против $5 и $25 у предыдущего Opus 5. Чтение из кэша стоит $0.20 за 1M токенов, это на 60% дешевле Opus 5. Запись в кэш — $5 за 1M. По тестам Anthropic, стоимость типичной задачи в режиме по умолчанию на 40% ниже, чем у Opus 5. Скорость генерации выросла более чем на 30%.

На Terminal-Bench 4.0 Opus 5.5 показывает 66.4%, на FrontierCode v1.1 (Main) 54.4%, на OSWorld 2.0 81.8% partial. Индекс Artificial Analysis 58, при медиане 25 среди моделей того же класса. METR по итогам предрелизной оценки заключает: Opus 5.5 это инкрементальное улучшение относительно Fable 5.1, без скачка, и вряд ли способен полностью автоматизировать AI R&D.

Где модель выигрывает по деньгам

Главный сдвиг в ценах: чтение из кэша по $0.20 за 1M. В кодинге и агентских сценариях именно они составляют основную часть затрат. Anthropic приводит пример: ревью и фикс 200 000 строк кода заняли у Opus 5.5 меньше трёх часов. Opus 5 на той же задаче тратил более 20 часов и в 2.5 раза больше токенов. По Terminal-Bench 4.0 на дефолтном уровне усилий Opus 5.5 на дефолтном уровне усилий обходит Opus 5 на максимальном усилии примерно за пятую часть стоимости задачи, а GPT-6 Astra — при стоимости около 40% от его цены.

Где модель не подходит

$20 за 1M выходных токенов выше медианы своего ценового класса ($10). Сам Opus 5.5 «очень многословен» по оценке Artificial Analysis: 260M выходных токенов на их наборе задач, при медиане 88M. Если в пайплайне важна короткая генерация в больших объёмах, разница в цене выходных токенов быстро съедает выгоду от дешёвого кэша.

Что проверить у себя

METR и Artificial Analysis дают общие цифры. У вашего проекта другой профиль вызова инструментов, другая длина сессий, другая доля чтений из кэша. В агентских нагрузках именно она определяет итоговый счёт. Стоит перемерить на своих задачах.