
Новости Together AI
Together AI — облако для обучения и инференса открытых моделей.
14 материал(ов) · последние обновления
Together AI: автомасштабирование LLM теперь видит реальную нагрузку
Система реагирует на очередь запросов, а не на загрузку GPU — и учитывает долгие холодные старты.
Together AI открыла Kimi K3: 2.8 триллиона параметров — и это крупнейшая открытая модель
Together AI предлагает инструменты для обучения и развертывания, снижая барьер для открытых моделей в продакшене.
Kimi K3 кодирует почти как Claude Fable 5 — за треть цены
Открытая модель Kimi K3 обгоняет Claude Fable 5 на повторных попытках и даёт полный контроль над развертыванием.
Together AI: открытые модели в продакшене — полный контроль без сборки стека
Готовые профили, тесты на реальном трафике и быстрый старт — чтобы продакшен не ломался.
Стартапы YC получают GPU в минуты — без авансов
Выделенный кластер позволяет платить за GPU по факту — вместо многолетних контрактов.
Inkling от Thinking Machines: ИИ, который думает ровно столько, сколько нужно
Модель принимает текст, изображения и аудио — и позволяет регулировать баланс точности и скорости.
Together AI: Provisioned Throughput гарантирует открытые LLM — за десятую часть цены
Сервис резервирует фиксированные мощности для MiniMax M3 и GLM-5.2, устраняя непредсказуемость serverless-инференса.
Together AI собрала $800 млн — и зафиксировала 500 МВт мощностей под открытый ИИ
Компания ставит на экономическую выгоду открытого ИИ для продакшена — и уже привлекает в 7 раз больше конкурентов.
ParallelKernelBench: лучшие LLM решают меньше трети задач на многогпу CUDA-ядра
Несколько сгенерированных ядер обогнали все публичные реализации — но воспроизводимость пока случайная.
Как Together AI запустила 1M-контекст MiniMax M3 в продакшне без деградации throughput
Together AI раскрыла инженерные решения, позволившие обслуживать MiniMax M3 (1M токенов, нативная мультимодальность, MSA-архитектура) с приростом throughput 81–125% на разных уровнях конкурентности. Это первый публичный…
Together AI: как построить рекордно быстрый Speech-to-Text стек
Together AI представила детальное техническое описание оптимизации всего стека преобразования речи в текст, включая GPU, CPU, память и сетевые протоколы, установив новый мировой рекорд скорости.
Gemma-4-31B-it-pearl: как крипто-майнинг удешевляет инференс AI
Together AI объединяет усилия с Pearl Research Labs, чтобы радикально изменить экономику инференса AI. В основе нового партнёрства лежит технология Proof of Useful Work, которая позволяет одновременно с вычислениями для…
violin: Открытый AI-перевод видео, который уважает голоса
Together AI выпустила Violin — полностью открытый инструмент для перевода видео, который разрушает языковые барьеры. Это комплексное решение объединяет распознавание речи, крупномодельный перевод и синтез речи, а также…
Voice Finder от Together AI: 600 голосов теперь можно искать по запросу
Together AI представила новый инструмент Voice Finder, который должен упростить процесс подбора подходящего голоса для приложений. Разработчики теперь смогут использовать естественный язык или аудиосэмплы для навигации…