ИИ-разработчики постоянно ищут баланс между производительностью, качеством и стоимостью моделей для своих приложений. Perplexity ответила на этот вызов, расширив возможности своих Agent API и Router API и добавив поддержку четырёх новых моделей, что даёт больше гибкости в выборе.
Perplexity теперь предлагает Google Gemini 3.7 Flash, NVIDIA Nemotron 3 Ultra, NVIDIA Nemotron 3.5 Lightning и DeepSeek V4 Flash 0731. Это расширяет выбор для инженеров, которые ищут различные комбинации скорости и эффективности, в том числе для задач рассуждения.
Модель Gemini 3.7 Flash от Google теперь доступна через оба API. Её стоимость составляет $0.375 за миллион входных токенов и $1.875 за миллион выходных. Кэшированные входные токены обойдутся в $0.0375 за миллион.
Также добавлена поддержка NVIDIA Nemotron 3 Ultra (550B параметров), размещенной на Perplexity. За неё просят $0.25 за миллион входных или кэшированных входных токенов и $2.50 за миллион выходных токенов.
Особо выделяется NVIDIA Nemotron 3.5 Lightning (30B параметров), также хостируемая Perplexity. Эта открытая модель позиционируется как быстрая и эффективная для задач рассуждения. Её цена ниже: $0.0115 за миллион входных токенов и $0.17 за миллион выходных. Кэшированные токены стоят всего $0.00115 за миллион.
Завершает список DeepSeek V4 Flash 0731, ещё одна быстрая и эффективная открытая модель для рассуждений, размещенная Perplexity. Её ключевая особенность — контекстное окно в 1 миллион токенов.
Добавление этих моделей позволяет инженерам более гибко подходить к оптимизации своих AI-приложений, выбирая между сторонними решениями, такими как Gemini Flash, и хостинговыми опенсорсными моделями от NVIDIA и DeepSeek. Прозрачное ценообразование и широкий выбор быстрых моделей подчёркивают стремление Perplexity стать универсальной платформой для ИИ-разработки.