Полный перевод статьи из блога Claude на русский. Оригинал — по ссылке.
ПОДКАСТ
По нашим оценкам, запуск Claude Opus 5.5 стоит примерно на 40% меньше, чем Opus 5, для типичных рабочих нагрузок с оплатой за токены. Для разработчиков важно, как именно суммируется эта экономия.
Если Вы платите за токены, наибольшую разницу в стоимости Вы увидите при более длительных сеансах с большим контекстом — именно в таких сеансах Claude Code, которые стали более распространёнными за последние шесть месяцев.
В этой публикации мы подробно рассмотрим механизмы, благодаря которым Opus 5.5 экономически эффективен с учётом того, как разработчики пишут код сегодня и, вероятно, будут писать его завтра.
Тенденции Claude Code
Мы собрали агрегированные данные о том, как разработчики использовали Claude Code с марта по сентябрь 2026 года. По мере улучшения возможностей моделей разработчики применяют агентов всё более сложными способами. Количество запросов за сеанс остаётся стабильным, но мы обнаружили несколько интересных особенностей поведения:
- Claude работает в 3,3 раза дольше над каждым запросом, совершая более чем на 40% больше вызовов модели на запрос. Прерываний стало на 68% меньше.
- Разработчики примерно вдвое чаще подключают сервер инструментов или используют навык и на треть реже вставляют текст в запрос.
- Контекст на запрос вырос в 2,6 раза. Соотношение входных и выходных токенов изменилось с 189:1 до 324:1.

Всё это указывает на то, что разработчики направляют более усердно работающего и лучше информированного Claude на более крупные, более открытые задачи. Для таких типов сессий экономический эффект от проектирования контекста усиливается.
Проще говоря, Claude читает больше токенов. Вам необходимо убедиться, что весь предоставляемый Вами контекст необходим, и что как можно большая часть этого контекста считывается из кэша.
Что делает Opus 5.5 экономически выгодным для длительных сессий с большим объёмом контекста
Есть три изменения, которые делают длительные сессии с большим объёмом контекста более экономически выгодными: изменения в ценообразовании, поведении модели и среде Claude Code. Давайте рассмотрим каждое из них.
Кэш недорог
Для использования с оплатой за токены мы снизили стоимость входных и выходных токенов на 20%, а цену чтения кэшированного токена — на 60%. Последнее снижение особенно значимо, поскольку чтение из кэша составляет большую часть затрат на агентную работу и программирование.
Как мы только что обсудили, объём контекста на запрос примерно в 2,6 раза вырос за шесть месяцев, а это означает, что экономия движется в правильном направлении. То же изменение цен для тех, кто платит за токены, обеспечивает большую экономию на нынешнем трафике Claude Code, чем шесть месяцев назад, поскольку теперь большую часть счёта составляет повторно считываемый контекст.
На дату публикации кэшированный токен в Opus 5.5 стоит пятую часть от стоимости аналогичного токена у конкурирующих моделей, при этом превосходя их.

Claude Code лучше использует кэш
Это в меньшей степени относится конкретно к Opus 5.5 и в большей — является результатом множества функций Claude Code, которые мы добавили за последние шесть месяцев. Учитывая тенденции сеансов программирования, которые мы только что обсудили, Вы могли бы ожидать более высокой доли промахов кэша, но верно обратное. Объём входных данных, не попадающих в кэш, сократился более чем на 50%.
Например, мы сделали так, чтобы Вам было сложнее случайно нарушить работу Вашего кэша из-за небольших неудобств, таких как обновление входа в систему. Мы также сделали так, чтобы его было сложнее нарушить более крупными действиями, такими как добавление инструкций в середине разговора или загрузка инструментов по запросу. Для более новых моделей, таких как Opus 5.5 и Fable 5.1, теперь Вы можете менять уровни усилий во время сеансов без сброса Вашего кэша.
Мы также сделали кэш более полезным для более длительных и делегированных сеансов. Разработчики с ключами API и облачные провайдеры теперь могут устанавливать срок хранения кэша в один час — это уже было доступно подписчикам — а разветвлённые подагенты начинают работу с кэша родительского агента вместо повторной оплаты за тот же контекст.
Та же задача, но с меньшим числом шагов
Opus 5.5 может потребовать меньше шагов, чем другие модели, для выполнения той же задачи. Zeta Labs отметила меньшее число шагов и вызовов инструментов на задачу по сравнению с Opus 5, но почти вдвое меньшую стоимость и вдвое больше выполненных наиболее сложных задач.
Это не будет справедливо для каждой задачи. В «Стоимость задачи на Opus 5.5» Адди написал: «В хорошо определённой задаче обе модели завершают работу примерно за одинаковое количество ходов, и всё, что Вы получаете, — это снижение цены. Разрыв должен быть наибольшим в задачах с открытым концом, где модель может потратить много ходов на неверную идею. Одно число не подходит для каждой кодовой базы, поэтому измеряйте».
Другими словами, простые, короткие и механические задачи потребуют одинакового количества ходов, тогда как в более долгих и сложных задачах Opus 5.5 имеет больше возможностей избежать траты токенов на неверный подход. Сокращение количества ходов даже экономичнее, чем кэшированный токен.
Также стоит отметить, особенно когда Claude работает дольше без присмотра или без перерывов, что Opus 5.5 генерирует вывод более чем на 30 % быстрее, чем Opus 5. Хотя это не повышает долю попаданий в кэш и не уменьшает использование токенов, это означает меньше ожидания при длительных запусках.
Защитите свои кэшированные чтения
По мере развития агентного программирования организации перешли от требования к разработчикам масштабироваться любой ценой к требованию масштабироваться эффективно. Выполните команду /usage в Claude Code, чтобы узнать, какая часть Вашего использования приходится на кэшированные чтения. Затем защитите этот показатель:
- Выбирайте модель в начале сеанса, а не переключайтесь в его середине,
- Выполняйте сжатие перед тем, как отойти, а не после, и
- Если Вы используете ключ API или облачного провайдера, установите время жизни кэша в один час для длительных сеансов.
Направляйте Opus 5.5 на открытую, требующую большого контекста работу, где эти привычки дают совокупный эффект, и ознакомьтесь с расчётами стоимости задачи на Opus 5.5.
Источник
Coding sessions are longer and use more context. Claude Opus 5.5 is built with that in mind.
https://claude.com/blog/claude-opus-5-5-built-for-coding-sessions-that-use-more-contextРедактор русской версии: Пётр Смывин.
Разбор подготовлен 25 сентября 2026.


