В то время как большинство моделей стремятся к балансу между качеством и ценой, OpenAI сделала шаг в сторону скорости, представив модель Astra, ориентированную на сверхбыстрые приложения. Это меняет подход к разработке систем, критичных к задержкам.
Astra предназначена для сценариев, где задержка критична, и доступна для использования в Codex и через API. Это открывает возможности для создания интерактивных агентов и real-time систем, требующих мгновенного ответа.
Модель GPT-6 Astra имеет свою ценовую категорию: $10 за миллион входных токенов и $50 за миллион выходных токенов. Это выше, чем у других моделей, например, GPT-6.1 Sol ($2/$10), что указывает на её нишевое применение для задач, где скорость оправдывает затраты.
Одновременно с Astra, OpenAI выпустила GPT-6.1 Sol, улучшив его соотношение стоимости и производительности. Основное изменение — снижение стоимости чтения из кэша с 10% до 5% от цены входных токенов. Это особенно выгодно для агентских рабочих нагрузок с повторяющимся контекстом, где кэширование часто используется.
Введение Astra демонстрирует стратегию OpenAI по созданию специализированных моделей для конкретных инженерных задач, где скорость становится приоритетом над стоимостью. Однако компания не предоставила точных бенчмарков скорости Astra по сравнению с другими моделями, что затрудняет оценку реальной выгоды от её использования на фоне пятикратного роста цен.