Стоимость выполнения задач в Opus 5.5: от чего зависят реальные затраты
Разбираем, как формируется цена за задачу при использовании Claude Code, почему важен кэш и когда стоит увеличить время на раздумья модели для итоговой экономии.

Суть
Снижение стоимости токенов в новых версиях языковых моделей не всегда означает пропорциональное уменьшение ваших счетов. Модель Opus 5.5 от Anthropic предлагает более выгодные тарифы, чем ее предшественница, однако реальная стоимость выполнения задачи зависит не только от прайс-листа. Ключевую роль играют количество итераций, эффективность использования кэша и объем вычислений, затрачиваемых на планирование ответа.
Контекст
При разработке функций или рефакторинге кода с помощью ИИ-агентов, таких как Claude Code, процесс представляет собой цикл. Модель читает контекст, вызывает инструмент, анализирует результат и повторяет эти шаги до завершения задачи. Каждая такая итерация требует повторной отправки всей истории диалога. Две разные модели с одинаковой ценой за токен могут обойтись в совершенно разные суммы для одной и той же задачи. Если одна модель решает проблему с первого раза, а другая требует нескольких попыток, вторая окажется значительно дороже из-за необходимости постоянно перечитывать растущий контекст.

Изображение из источника
Детали
В модели Opus 5.5 цены распределяются следующим образом: 4 доллара за миллион входных токенов, 20 долларов за миллион выходных и всего 0.20 доллара за миллион токенов, прочитанных из кэша. По сравнению с предыдущей версией (Opus 5), входные и выходные токены подешевели на 20%, а чтение из кэша — на 60%.
На итоговую стоимость влияют четыре фактора:
- Итерации (Turns). Каждая новая попытка отправляет весь предыдущий контекст заново. Меньше итераций — меньше затрат.
- Чтение из кэша. Повторяющийся текст тарифицируется по цене кэша, что составляет крошечную долю от базовой стоимости. При показателе попадания в кэш на уровне 90% стоимость обработки входных данных падает радикально.
- Выходные токены. Это самая дорогая часть, превышающая базовый входной тариф в пять раз. Сюда же входят скрытые токены "размышлений" (thinking) модели.
- Выбор модели. Разные архитектуры по-разному расходуют токены на достижение результата.
Например, задача, начинающаяся с 20 тысяч токенов и вырастающая до 120 тысяч, за 40 итераций обработает около 2.8 миллиона входных токенов. Без кэша это обошлось бы в 11.20 доллара. Однако при 90-процентном использовании кэша цена падает до 1.62 доллара.

Изображение из источника
Анализ
Главный компромисс в экономике ИИ-агентов заключается в том, что попытка сэкономить токены может стоить вам невыполненной задачи. Снижение "усилий" (effort) модели или урезание контекста действительно экономит ресурсы в моменте. Однако, если из-за этого модель совершит ошибку, повторный цикл обойдется дороже, чем изначальная экономия.
Выходные токены в Opus 5.5 стоят в 100 раз дороже чтения из кэша. Поскольку модель всегда "думает" перед ответом, эти размышления тарифицируются как выходные данные. Повышение параметра усилий заставляет модель дольше планировать свои действия. Это увеличивает счет за генерацию, но часто предотвращает ложные шаги. Если дополнительные 20 тысяч токенов размышлений (около 0.40 доллара) спасают от десяти лишних итераций с перечитыванием 100 тысяч токенов контекста, такая инвестиция полностью окупает себя.
Перспектива
По мере того как ИИ-агенты будут брать на себя все более сложные и длительные задачи, фокус разработчиков сместится с простой цены за токен на метрику "стоимость успешного завершения задачи". Инструменты разработки будут активнее внедрять механизмы автоматического тестирования гипотез внутри цикла ИИ, чтобы модель могла проверять свой код до отправки финального ответа. Умение правильно настраивать кэширование и управлять уровнем автономности агента станет базовым навыком инженеров в ближайшие годы.
TL;DR
Главное
Цена за токен не отражает реальную стоимость задачи; ключевую роль играет количество итераций и грамотное использование кэша контекста.
Ключевые факты
- /Чтение из кэша в Opus 5.5 стоит всего $0.20 за миллион токенов.
- /Выходные токены, включая процесс размышления, обходятся в $20 за миллион.
- /Эффективное кэширование может снизить затраты на входные данные на 90%.
Инсайт
Увеличение затрат на предварительные размышления модели часто экономит деньги, так как предотвращает повторные отправки огромного контекста из-за ошибок в коде.




