0%прочитано

Разбор публикации

Сколько стоит задача на Opus 5.5

6 мин чтения Оригинал на claude.com

Полный перевод статьи из блога Claude на русский. Оригинал — по ссылке.

ПОДКАСТ

Стоимость задачи и стоимость повторной попытки

Вы не ставите перед собой цель купить миллионы токенов. Вы стремитесь создать функцию, завершить миграцию или выполнить задачу. Количество токенов — это столько, сколько модели потребовалось для достижения цели.

Две модели с одинаковой стоимостью за токен могут стоить совершенно по-разному при выполнении одной и той же задачи. Одна читает код один раз. Другая читает его, пробует исправление и читает снова. Каждый из этих шагов — это ход, и каждый ход повторно отправляет весь разговор на данный момент. Поэтому модель, которой требуется больше ходов, стоит дороже даже при одинаковой цене.

К концу этой публикации Вы сможете ответить на три вопроса о своей работе:

  • Во сколько мне обходятся мои типичные задачи на Opus 5.5?
  • Какие настройки влияют на это и насколько?
  • Как мне проверить использование в собственном сеансе?

Компромисс, которым я хочу сразу поделиться, заключается в том, что каждый способ потратить меньше токенов также может стоить Вам завершённой задачи. Меньшие усилия, меньшая модель или меньший объём контекста определённо могут сэкономить токены. Повторная попытка стоит больше, чем эта экономия. Эта публикация пытается определить цену каждого компромисса.

Некоторые числа здесь — это прейскурантные цены, а некоторые — иллюстрации, построенные на их основе. Диаграммы интерактивны, поэтому изменяйте входные данные по мере чтения. Это иллюстрации, составленные добросовестно, поэтому обязательно сверяйтесь с нашей документацией и собственными расчётами.

Сколько стоит задача?

Задача в Claude Code — это цикл. Модель читает разговор, вызывает инструмент, читает результат и повторяет цикл, пока не завершит работу. Каждый проход цикла — это один запрос. Стоимость цикла определяют четыре фактора.

Ходы. Каждый ход повторно отправляет весь разговор к этому моменту. Меньшее число ходов означает обработку меньшего объёма входных данных.

Чтения кэша. Большая часть того, что повторно отправляется при ходе, — это текст, который модель видела на предыдущем ходе. За него взимается плата как за чтение кэша, составляющая небольшую долю стоимости входных данных.

Тип выходных токенов. Самые дорогие токены — в пять раз дороже входных. Мышление оплачивается как выходные данные, поэтому модель, которая меньше рассуждает на пути к ответу, стоит дешевле.

Модель. У каждой модели свои цены, указанные на странице с ценами, поэтому выбранная Вами модель определяет стоимость каждого токена.

В наших примерах используются тарифы API Opus 5.5 из прайс-листа: 4 доллара за миллион входных токенов, 20 долларов за миллион выходных токенов и 0,20 доллара за миллион чтений из кэша. Как и калькулятор ниже, примеры учитывают кэшированный ввод по цене чтения, а всё остальное — по цене ввода, и не включают записи в кэш. Количество токенов приведено для иллюстрации.

Ходы

Допустим, задача начинается с 20 тысяч токенов контекста и увеличивается до 120 тысяч, пока модель читает файлы и результаты инструментов. При 40 ходах в среднем за ход отправляется около 70 тысяч токенов. Это около 2,8 миллиона входных токенов для задачи, хотя объём разговора никогда не превышал 120 тысяч. При 90 % чтений из кэша входные данные стоят около 1,62 доллара. Та же задача за 25 ходов обрабатывает около 1,75 миллиона токенов и стоит около 1,02 доллара за входные данные.

Ход стоит больше, чем добавляемые им токены, потому что он повторно отправляет всё, что было до него. Поэтому самый дешёвый ход — тот, который Вам не нужен. 

Одна привычка, которая может сократить количество ходов, — дать модели способ проверить свою работу. Например, тест для запуска, сборку или скрипт, вызывающий конечную точку. Модель, которая может проверять собственную работу, раньше находит свои ошибки.

Модель, которая собирает всё необходимое за один проход и группирует вызовы инструментов, также реже платит за повторную отправку.

Чтения из кэша

Те же 2,8 млн входных токенов стоят 11,20 доллара США, если ни один из них не поступает из кэша. При коэффициенте попаданий 90 % они стоят 1,62 доллара США, а при 96 % — около 0,99 доллара США. Ни одна другая настройка не влияет на стоимость входных данных настолько сильно. Стабильная сессия сама по себе поддерживает высокий коэффициент попаданий. Далее в этой публикации я рассказываю о некоторых действиях, которые помогут Вам не нарушить работу кэша.

Выходные токены

В Opus 5.5 выходной токен стоит в 100 раз дороже чтения из кэша. 60 тыс. выходных токенов типичной задачи стоят 1,20 доллара США — столько же, сколько чтение 6 млн токенов из кэша. Выходные данные включают рассуждения. Вы платите за всё это, даже когда Claude Code показывает Вам только сводку. Вот почему усилия, которые в основном меняют объём рассуждений модели, так сильно влияют на счёт.

Модель

Модель с более дешёвым чтением из кэша в основном помогает при длительных сессиях. Модель с более дешёвым выводом в основном помогает при задачах, требующих большого объёма рассуждений.

Что изменилось в Opus 5.5

Изменились две вещи: цена и объём работы, который выполняет модель.

Каждая строка цен ниже. Входные и выходные токены на 20% дешевле, чем у Opus 5. Чтение кэша на 60% дешевле. Цена входных данных снижается, и вместе с ней снижается ставка чтения — с одной десятой цены входных данных до одной двадцатой. На рис. A сравниваются две модели на миллион токенов. Это прейскурантные цены API. В тарифах Pro, Max или Team более низкая цена Opus 5.5 применяется к Вашим лимитам, включая кэшированный контекст, поэтому их хватает примерно на 25% дольше, чем с Opus 5. Дополнительное снижение стоимости чтения кэша — это изменение цены API.

Рис. A. Цена за миллион токенов.

При использовании ключа API снижение цены чтения кэша наиболее важно для Claude Code.  В ходе долгого агентного сеанса большая часть входных данных приходится на чтение кэша. В сеансе, цена которого указана на рис. B ниже, строка кэша снижается с 1,00 доллара США до 0,40 доллара США — это самое большое снижение в счёте.

То, сколько Вы сэкономите, зависит от характера Вашей работы. Сеанс, состоящий преимущественно из чтения кэша, может сэкономить до 60% на входных данных. Короткий вопрос без кэша и длинный ответ могут сэкономить до 20%, поскольку в этом случае преобладает вывод. Большинство задач Claude Code находятся между этими двумя вариантами. Калькулятор ниже показывает, к какому относится Ваша задача.

Opus 5.5 может использовать больше токенов в ответе, потому что он всегда думает перед тем, как ответить. Мы ожидаем, что люди смогут сделать больше с Opus 5.5, но это зависит от задачи, поэтому измеряйте это на своей работе.  Рисунок C сравнивает стоимость одной задачи у двух моделей. Эта часть гораздо сильнее зависит от Вашей работы, чем от цены.

В хорошо определённой задаче обе модели выполняют её примерно за одинаковое число шагов, и Вы получаете только снижение цены. Разрыв должен быть наибольшим в задачах с открытым результатом, где модель может потратить много шагов на неверную идею. Одно число не подходит для каждой кодовой базы, поэтому измеряйте это (см. последний раздел).

Длинные запуски заканчиваются отчётом. Opus 5.5 завершает долгий запуск описанием того, что он изменил, что нашёл и что ему нужно от Вас. Это также может сэкономить деньги, потому что Вы реже перезапускаете сеанс, когда видите, что произошло.

Одни и те же задачи рядом

Рисунок B показывает стоимость одного сеанса на обеих моделях при одинаковом количестве токенов. Таким образом, разница заключается только в изменении цены и ни в чём другом. Переключайте модели для сравнения. Количество токенов приведено в качестве иллюстрации.

Источник

What a task costs on Opus 5.5

https://claude.com/blog/what-a-task-costs-on-opus-5-5

Редактор русской версии: Пётр Смывин.

Разбор подготовлен 23 сентября 2026.

Другие разборы

Все материалы
18 сентября 2026 Как Balyasny Asset Management оценивает и управляет Claude Fable 5 на переднем крае искусственного интеллекта Balyasny Asset Management, глобальная мультистратегическая инвестиционная компания с активами примерно на 38 миллиардов долларов и командой около 2 000 специалистов, в 2026 году перешла от систем искусственного интеллекта, выполняющих поиск, к агентам, способным самостоятельно выполнять длительную многошаговую работу до получения завершенного результата. 18 сентября 2026 Проекты Claude Code переработаны: от папки к управляемому диалогу В Claude Code проекты становятся средой для длительной многозадачной работы: пользователь задаёт цель и контекст, а Claude самостоятельно определяет объём задач, распределяет их между потоками, координирует выполнение, проверяет результаты и собирает итоговый результат. 17 сентября 2026 Claude Cowork и чат объединяются в единый Claude Anthropic объединяет Claude Cowork и обычный чат в единый интерфейс Claude, чтобы пользователям не приходилось выбирать отдельное место для крупных, визуальных или обычных задач.

Хотите, чтобы вас рекомендовал ChatGPT?

Бесплатный аудит. Покажем, где сайт уже виден ИИ — и где теряете клиентов.

Без подписки PDF за 24 часа Краснодар · вся Россия
Получить GEO-аудит