AI News Watcher
Saturday, Aug 15, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Aug 15, 2026 · 1 min read · Perplexity ← Back to feed

Perplexity API расширил выбор: Gemini Flash, Nemotron и DeepSeek — есть модели за 1 цент за 1М токенов daily

Платформа расширила линейку быстрых и эффективных моделей, предлагая как сторонние, так и свои хостинговые решения.

Perplexity API расширил выбор: Gemini Flash, Nemotron и DeepSeek — есть модели за 1 цент за 1М токенов
Редакция · Daily briefing

ИИ-разработчики постоянно ищут баланс между производительностью, качеством и стоимостью моделей для своих приложений. Perplexity ответила на этот вызов, расширив возможности своих Agent API и Router API и добавив поддержку четырёх новых моделей, что даёт больше гибкости в выборе.

Perplexity теперь предлагает Google Gemini 3.7 Flash, NVIDIA Nemotron 3 Ultra, NVIDIA Nemotron 3.5 Lightning и DeepSeek V4 Flash 0731. Это расширяет выбор для инженеров, которые ищут различные комбинации скорости и эффективности, в том числе для задач рассуждения.

Модель Gemini 3.7 Flash от Google теперь доступна через оба API. Её стоимость составляет $0.375 за миллион входных токенов и $1.875 за миллион выходных. Кэшированные входные токены обойдутся в $0.0375 за миллион.

Также добавлена поддержка NVIDIA Nemotron 3 Ultra (550B параметров), размещенной на Perplexity. За неё просят $0.25 за миллион входных или кэшированных входных токенов и $2.50 за миллион выходных токенов.

Особо выделяется NVIDIA Nemotron 3.5 Lightning (30B параметров), также хостируемая Perplexity. Эта открытая модель позиционируется как быстрая и эффективная для задач рассуждения. Её цена ниже: $0.0115 за миллион входных токенов и $0.17 за миллион выходных. Кэшированные токены стоят всего $0.00115 за миллион.

Завершает список DeepSeek V4 Flash 0731, ещё одна быстрая и эффективная открытая модель для рассуждений, размещенная Perplexity. Её ключевая особенность — контекстное окно в 1 миллион токенов.

Добавление этих моделей позволяет инженерам более гибко подходить к оптимизации своих AI-приложений, выбирая между сторонними решениями, такими как Gemini Flash, и хостинговыми опенсорсными моделями от NVIDIA и DeepSeek. Прозрачное ценообразование и широкий выбор быстрых моделей подчёркивают стремление Perplexity стать универсальной платформой для ИИ-разработки.

Дополнительные источники

  1. https://docs.perplexity.ai/guides/pricing
  2. https://docs.perplexity.ai/docs/gateway/models
  3. https://docs.perplexity.ai/docs/agent-api/models
  4. https://www.together.ai/pricing
  5. https://docs.perplexity.ai/docs/gateway/quickstart
  6. llms.txt

Источники

  1. https://docs.perplexity.ai/docs/resources/changelog#august-2026 docs
→ Опубликовано в Telegram: @agentic_ai_news/873