Разработчики всё чаще используют ИИ-агентов для сложных и открытых задач, что приводит к более длинным сессиям и глубокой работе с контекстом. Anthropic ответила на этот тренд, выпустив Claude Opus 5.5 — модель, оптимизированную для таких сценариев, которая обещает до 40% экономии на типичных задачах.
Opus 5.5 снижает стоимость и повышает эффективность ИИ-ассистированного кодинга для сложных и длительных задач. По оценкам Anthropic, модель обходится примерно на 40% дешевле, чем Opus 5, для типичных рабочих нагрузок, тарифицируемых по токенам. Один из тестировщиков с помощью Opus 5.5 перенёс 680 тысяч строк кода меньше чем за день.
Экономия стала возможной благодаря трём основным изменениям:
- Ценообразование — стоимость входных и выходных токенов снижена на 20%, а цена чтения кэшированного токена — на 60%. Это особенно важно, так как кэшированные чтения составляют большую часть расходов в агентной работе с кодом. За последние полгода объём контекста на запрос вырос в 2.6 раза, а кэшированный токен в Opus 5.5 стоит в пять раз дешевле, чем у конкурентов.
- Улучшенное использование кэша — модель стала лучше работать с кэшем, что привело к сокращению промахов более чем на 50%. Теперь сложнее случайно сбросить кэш, например, при обновлении логина или добавлении инструкций в середине разговора. Разработчики, использующие API-ключи и облачные провайдеры, получили часовое время жизни кэша.
- Меньше итераций — Opus 5.5 требует меньше «ходов» для выполнения той же задачи, чем другие модели. В Zeta Labs отметили, что Opus 5.5 сократил число итераций и вызовов инструментов, что привело к почти двукратному снижению стоимости и выполнению вдвое большего количества сложных задач. Для простых задач экономия может быть только за счёт снижения цены токенов, но для открытых задач потенциал экономии выше, так как модель реже выбирает неверный подход. Также Opus 5.5 генерирует выходные данные более чем на 30% быстрее, чем Opus 5.
Вместе с релизом Opus 5.5 Anthropic также расширила категории отказов, за которые взимается плата до вывода какого-либо результата. Теперь тарифицируются отказы, если stop_details.category относится к "bio", "frontier_llm" или "reasoning_extraction" — это категории с низким уровнем ложных срабатываний. Отказы, произошедшие в середине потока, уже тарифицировались. Отказы до вывода результата в других категориях остаются бесплатными.
Opus 5.5 напрямую реагирует на меняющиеся паттерны использования ИИ-агентов, где растёт важность глубокого контекста и продолжительных сессий. Anthropic стремится сделать такие задачи экономически выгодными для разработчиков, но при этом расширяет оплачиваемые категории отказов, что требует внимательности к запросам, которые могут быть расценены как опасные.