AI News Watcher
Thursday, Sep 10, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Sep 10, 2026 · 1 min read · Together AI ← Back to feed

Together AI: GPU-мощности вдвое дешевле — если их можно прервать daily

Задачи на таких узлах могут быть остановлены в любой момент — но с пятиминутным окном на завершение.

Together AI: GPU-мощности вдвое дешевле — если их можно прервать
Редакция · Daily briefing

Высокая стоимость GPU-мощностей — одна из главных проблем в развитии AI. Together AI предлагает решение: получить те же вычислительные ресурсы вдвое дешевле, если быть готовым к их внезапной остановке.

Together AI ввела "preemptible compute" — предварительно отбираемые вычислительные мощности для Together GPU Clusters. Это позволяет снизить стоимость GPU-ресурсов на 50% по сравнению со стандартными тарифами. Главное условие: такие узлы могут быть остановлены (прерваны) в любой момент. Система даст до пяти минут на завершение текущих задач, прежде чем отключит узел.

Эти узлы не гарантируют минимального времени работы: они заполняются асинхронно, когда появляются свободные мощности. Вместо фиксированной ставки, их использование тарифицируется поминутно. Функция доступна для Kubernetes-кластеров Together AI, но пока не работает со Slurm. Каждый кластер должен содержать хотя бы один стандартный узел.

Такой подход подходит для рабочих нагрузок, которые могут быть остановлены и перезапущены без потери данных. Примеры включают обучение моделей с чекпойнтами, пакетную обработку данных или эксперименты, не требующие непрерывной работы. Приоритет здесь — экономия, а не гарантированная доступность.

Вводя "preemptible compute", Together AI предлагает инженерам больше гибкости в управлении бюджетом на GPU. Это требует от разработчиков проектировать отказоустойчивые системы, способные безболезненно переживать остановки узлов, но взамен даёт существенную экономию.

Дополнительные источники

  1. https://docs.together.ai/docs/preemptible-compute
  2. https://www.together.ai/blog/thunderkittens-nvidia-blackwell-gpus
  3. https://hazyresearch.stanford.edu/blog/2026-02-19-tk-2
  4. thundercompute.com

Источники

  1. https://www.together.ai/blog/introducing-preemptible-compute-the-same-compute-half-the-price blog
  2. https://www.together.ai/blog/to-infinity-and-beyond-thunderkittens-now-on-nvidia-vera-rubin-nvl72 blog
→ Опубликовано в Telegram: @agentic_ai_news/1014