Для по-настоящему автономных AI-агентов нужна модель, которая не только рассуждает, но и быстро обрабатывает огромный контекст. Perplexity добавила такую в свой Agent API: NVIDIA Nemotron 3.5 Lightning 30B-A3B.
Perplexity интегрировала Nemotron 3.5 Lightning, модель, специально разработанную NVIDIA для создания долгоживущих автономных агентов и сложных рабочих процессов. Это даёт разработчикам доступ к решению, оптимизированному для агентских задач.
Модель выделяется гибридной архитектурой Mixture-of-Experts (MoE) с использованием слоев Mamba-2 и Attention. Она имеет 3 миллиарда активных параметров из 30 миллиардов общих, поддерживает до 1 миллиона токенов контекста и включает методы спекулятивного декодирования для ускорения генерации текста.
Стоимость использования Nemotron 3.5 Lightning через Perplexity Agent API приведена ниже. Perplexity заявляет о прямом ценообразовании без наценки:
- Входные токены — $0.0115 за миллион.
- Кешированные входные токены — $0.00115 за миллион.
- Выходные токены — $0.17 за миллион.
Интеграция Nemotron 3.5 Lightning расширяет набор специализированных инструментов в Agent API Perplexity, предлагая разработчикам модель, созданную для самых требовательных сценариев с автономными агентами. Акцент на прозрачности ценообразования без наценки дополняет предложение, делая выбор этой модели более предсказуемым.