Выход Claude Opus 5.5: как Anthropic оптимизирует затраты на длительные сессии программирования
Anthropic выпустила модель Claude Opus 5.5, снизив стоимость работы с кэшем на 60%. Обновление нацелено на разработчиков, использующих длинные контексты и сложные автономные сценарии.

Компания Anthropic представила обновленную модель Claude Opus 5.5, созданную с учетом изменившихся привычек разработчиков. Главное нововведение заключается не в радикальном росте интеллекта, а в глубокой экономической оптимизации. По оценкам компании, выполнение типичных задач с оплатой за токены обойдется примерно на сорок процентов дешевле по сравнению с предыдущей версией Opus 5. Это обновление критически важно для тех, кто использует большие языковые модели (LLM) для работы с объемными кодовыми базами.
За последние полгода паттерны использования искусственного интеллекта в программировании заметно изменились. Разработчики все чаще доверяют моделям сложные, открытые задачи, требующие длительной автономной работы. Статистика использования Claude Code с марта по сентябрь 2026 года показывает, что объем контекста в каждом запросе вырос в два с половиной раза. Соотношение входящих токенов к исходящим изменилось с 189:1 до 324:1.

Изображение из источника
Кроме того, модель теперь работает над каждым промптом в три с лишним раза дольше, совершая на сорок процентов больше внутренних вызовов. Разработчики стали в два раза чаще подключать серверы инструментов и реже просто копировать текст в окно диалога. Все это приводит к тому, что модель читает огромные объемы данных, и стоимость этого чтения становится главным фактором затрат при разработке.
Чтобы адаптироваться к этой реальности, Anthropic пересмотрела ценообразование. Базовая стоимость входящих и исходящих токенов снижена на двадцать процентов. Однако самое важное изменение — падение цены на чтение кэшированных токенов на шестьдесят процентов. Теперь чтение из кэша в Opus 5.5 обходится в пять раз дешевле, чем у конкурирующих моделей сопоставимого класса.
Техническая реализация кэширования также улучшилась. Количество промахов мимо кэша (cache misses) сократилось более чем вдвое. Разработчики сделали так, чтобы мелкие действия, вроде обновления авторизации или добавления инструкций в середине диалога, не сбрасывали накопленный контекст. Для пользователей программного интерфейса (API) добавлена возможность устанавливать время жизни кэша до одного часа, а дочерние агенты теперь наследуют кэш родительского процесса без дополнительной платы.

Изображение из источника
Скорость генерации ответов у Opus 5.5 выросла на тридцать процентов по сравнению с пятой версией. Хотя это напрямую не влияет на расход токенов, это значительно сокращает время ожидания при длительных запусках агентов. Тестирование в реальных условиях, например, компанией Zeta Labs, показало, что новая модель требует меньше итераций и вызовов инструментов для завершения задачи. На сложных задачах они зафиксировали двукратный рост успешных завершений при почти двукратном снижении затрат.
Эти изменения отражают важный сдвиг в индустрии. Компании переходят от концепции масштабирования любой ценой к эффективному росту. Экономика разработки с помощью искусственного интеллекта теперь строится вокруг инженерии контекста (context engineering). Чем лучше разработчик управляет кэшем и структурирует сессии, тем дешевле обходится создание программного обеспечения.
В будущем мы увидим еще большую автоматизацию процессов написания кода, где модели будут работать фоном часами. Однако это потребует от инженеров новых навыков: умения правильно инициализировать сессии, выбирать подходящую модель на старте и грамотно управлять жизненным циклом кэша. Время покажет, насколько быстро индустрия адаптируется к этим новым правилам экономической эффективности.
TL;DR
Главное
Anthropic адаптировала модель Claude Opus 5.5 под современные реалии программирования, сделав ставку на радикальное удешевление работы с длинным контекстом и системным кэшем.
Ключевые факты
- /Стоимость чтения кэшированных токенов снижена на 60%.
- /Объем контекста на один запрос вырос в 2.6 раза за полгода.
- /Скорость генерации ответов увеличилась на 30% по сравнению с Opus 5.
Инсайт
Главной статьей расходов при использовании ИИ в программировании стало не создание нового кода, а многократное перечитывание моделью существующего контекста.



