Получить ранний доступ к ещё не выпущенной модели от крупного вендора — редкая возможность. Perplexity предлагает именно это: openai/gpt-6-luna теперь доступна через её Agent API, но с определёнными условиями.
Perplexity обновила свой быстрый предустановленный режим Agent API. Теперь он использует модель openai/gpt-6-luna с нулевым усилием рассуждений (reasoning effort: none) и приоритетной обработкой (priority processing). Это значит, что модель оптимизирована для максимально быстрых и прямых ответов, а не для сложных многоступенчатых рассуждений. Приоритетная обработка обеспечивает ускоренное выполнение запросов.
Для работы с новой конфигурацией есть два подхода:
- Динамические запросы — если вы используете предустановленный режим по имени, изменения подхватятся автоматически.
- Замороженные конфигурации — если ваша конфигурация зафиксирована, потребуется вручную обновить используемую модель, усилие рассуждений и установить параметр
service_tierв значениеpriority.
Важно учесть, что приоритетная обработка увеличивает стоимость токенов вдвое по сравнению со стандартными ценами на токены модели. Это плата за ранний доступ к gpt-6-luna, которая ещё не выпущена OpenAI для широкого использования, и за ускоренное выполнение запросов.
Для инженеров, которым нужна максимальная скорость и прямой ответ, готовых платить за ранний доступ и приоритет, это может быть ценным предложением. Однако модель специально настроена на быстрые, а не глубокие ответы, что стоит учитывать при выборе режима.