AI News Watcher
Monday, Aug 24, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Aug 24, 2026 · 2 min read · Groq ← Back to feed

Groq ускорит агентов с NVIDIA Groq 3 LPX — до 3400 токенов в секунду daily

Облако Groq, известное своими LPU, расширяется ускорителями NVIDIA Groq 3 LPX для сложных и требовательных агентных задач.

Groq ускорит агентов с NVIDIA Groq 3 LPX — до 3400 токенов в секунду
Редакция · Daily briefing

Groq, известный своей архитектурой для быстрого инференса, теперь будет использовать специализированный ускоритель NVIDIA Groq 3 LPX. Это позволит компании одной из первых предложить разработчикам скорость для самых требовательных агентных AI-систем в своём облаке.

Groq станет одним из первых, кто развернёт ускоритель NVIDIA Groq 3 LPX для генерации токенов на платформе NVIDIA Vera Rubin NVL72 в своём облаке AI-инференса. Развёртывание происходит в партнёрстве с Dell Technologies. NVIDIA Groq 3 LPX разработан специально для увеличения скорости генерации токенов, что критически важно для ресурсоёмких агентных систем.

В бенчмарках Artificial Analysis ускоритель показал выдающуюся производительность: до 3400 выходных токенов в секунду при работе с моделью Gemma 4 31B (открытая агентная модель) и контекстом в 100 000 токенов. Это рекордный показатель для данной модели. Благодаря Groq 3 LPX интерактивность для чувствительных к задержкам агентных AI-нагрузок вырастет в четыре раза по сравнению с ближайшими альтернативными платформами, что позволит сократить время выполнения таких задач, как кодирование, с часов до минут.

Groq уже имеет опыт эксплуатации собственных процессоров LPU в продакшене. За август 2026 года компания стала NVIDIA Cloud Partner, что позволяет ей развёртывать и управлять решениями на базе эталонной архитектуры NVIDIA. Её облачная платформа GroqCloud обслуживает более шести миллионов разработчиков и тысячи AI-компаний, генерируя триллионы токенов еженедельно. Недавнее привлечение $1 млрд инвестиций ($350 млн в августе 2026 года, включая участие NVIDIA, и $650 млн в июне 2026 года) позволит Groq масштабировать свою инфраструктуру с 54 до более чем 200 мегаватт в 2027 году.

Этот шаг Groq, известного своими LPU, демонстрирует прагматичный подход: компания готова использовать сторонние решения для достижения максимальной скорости в требовательных агентных задачах. Вопрос в том, как NVIDIA Groq 3 LPX будет сосуществовать с собственными LPU Groq и повлияет ли это на дальнейшее развитие их архитектуры.

Дополнительные источники

  1. Groq Closes $350 million Series A, Building the World's Leading AI Inference Cloud
  2. NVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AI
  3. NVIDIA Partner Network
  4. cerebras.ai
  5. semianalysis.com

Источники

  1. https://groq.com/blog/groq-among-the-first-to-bring-nvidia-groq-3-lpx-and-vera-rubin-nvl72-to-market blog
→ Опубликовано в Telegram: @agentic_ai_news/905