Пока крупные игроки наращивают параметры своих моделей, Anthropic делает ставку на скорость и экономичность. Компания выпустила Claude Haiku 5.5, позиционируя её как самую быструю и дешёвую модель для высоконагруженных задач, одновременно расширив её возможности по обработке данных.
Ключевое обновление Haiku 5.5 — это контекстное окно в 1 миллион токенов и максимальный выход в 128 тысяч токенов, что для обработки больших объёмов данных. Модель также получила функцию «адаптивного мышления» через параметр effort, позволяющую регулировать уровень усилий модели для оптимизации производительности и стоимости.
Haiku 5.5 ориентирована на высокообъёмные и чувствительные к задержкам задачи, а также на сценарии, где важна стоимость. Anthropic подчёркивает эту стратегию, вдвое снизив цену на чтение кэша подсказок для Claude Sonnet 5.5: с $0.20 до $0.10 за миллион токенов.
Модель доступна через Claude API, Claude в Amazon Bedrock, Claude Platform на AWS, Claude на Google Cloud и Claude в Microsoft Foundry. Разработчикам следует учесть, что код, написанный для Claude Haiku 4.5, может быть несовместим с новой версией, а ручное расширенное мышление (budget_tokens) теперь приводит к ошибке 400. Адаптивное мышление теперь включено по умолчанию.
Выпуск Haiku 5.5 с акцентом на скорость, стоимость и огромный контекст демонстрирует стремление Anthropic занять лидирующие позиции в сегменте «малых» моделей, способных обрабатывать большие объёмы данных. Однако компания не предоставила прямых бенчмарков, подтверждающих заявленную «самую быструю» и «самую дешёвую» производительность по сравнению с конкурентами.