Новости AI-стека

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · Deepgram · Deepgram · TG #336

Выпущена версия v1.17.0 Hugging Face Hub с кросс-репозиторным копированием, SSH в Spaces и улучшенными таблицами CLI

Версия 1.17.0 клиента Hugging Face Hub управления файлами, отладки в Spaces и навигации по моделям.

8 мин

28 МАЯ

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Майский релиз Deepgram Self-Hosted 2026 года привносит расширенную фильтрацию ненормативной лексики и повышенную точность для корейского языка, а также важные изменения для будущих архитектурных обновлений движка.

27 МАЯ

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Deepgram интегрировал модель Gemini 3.5 Flash в Voice Agent API, требуя от пользователей Gemini 2.5 Flash мигрировать до октября из-за предстоящего прекращения поддержки.

27 МАЯ

Hugging Face: Синхронизация дельта-весов в TRL сокращает передачу данных с терабайта до мегабайт

Hugging Face представила новую функцию в библиотеке TRL, значительно уменьшающую объем данных для синхронизации весов в асинхронном обучении с подкреплением.

10 мин

27 МАЯ

Runway Seedance: инцидент с генерациями быстро устранен

На платформе Runway 27 мая 2026 года произошел кратковременный инцидент с генерациями Seedance, который был устранен за 33 минуты.

26 МАЯ

Hugging Face Hub: Важный Hotfix устраняет проблемы с typer

Изменения в библиотеке Typer версии 0.26.0 привели к критическим сбоям в работе командной строки Hugging Face Hub, что потребовало незамедлительного выпуска исправления v1.16.3.

5 мин

26 МАЯ

Project Luxo: AI-видео перестает быть демонстрацией технологий и начинает рассказывать истории

Runway ML утверждает, что модель Aleph 2.0 позволила AI-генерированному видео преодолеть "зловещую долину" и фокусироваться на эмоциональном повествовании.

11 мин

25 МАЯ

Hugging Face: наводим порядок в терминологии AI-агентов

Hugging Face предлагает стандартизированный глоссарий для устранения путаницы в ключевых понятиях AI-агентов, обеспечивая общее понимание в быстроразвивающейся области.

9 мин

25 МАЯ

Runway: Сбои в генерации GPT Image 2 устранены, но Veo 3.1 пока нестабилен

Платформа Runway оперативно решила проблемы с генерацией изображений GPT Image 2, однако сбои в работе Veo 3.1 также были зафиксированы и устранены.

22 МАЯ

Специализированные модели: 3B-решения опережают флагманы по всем фронтам

Последние три года в AI-стратегии компаний доминировала простая логика: чем крупнее фронтир-модель, тем безопаснее. Считалось, что возможности масштабируются с числом параметров, а лидеры бенчмарков неизменно предлагают…

20 МАЯ

Transformers 5.9.0: новые модели и меняющийся интерфейс эмбеддингов

HuggingFace выпустил библиотеку Transformers v5.9.0, добавив три новые модели и внеся важные изменения в обработку текстовых эмбеддингов для ряда моделей компьютерного зрения. Это обновление включает как новые…

19 МАЯ

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram объявил о доступности Gemini 3.1 Flash Lite в своём Voice Agent API, который теперь полностью управляем Google. Это означает, что предварительная версия модели устаревает, и всем пользователям предстоит…

1 мин

19 МАЯ

Ettin Reranker: как пересортировать поиск без лишних затрат

Hugging Face представил семейство моделей Ettin Reranker. Это не просто очередной набор инструментов для ранжирования; они спроектированы, чтобы точно переупорядочивать результаты поиска, при этом удерживая контроль над…

Daily · Stability AI · Stability AI

18 МАЯ

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI выпустила Stable Audio 3 — новую открытую модель для генерации и редактирования аудио. Эта модель представляет собой семейство быстрых латентных диффузионных моделей, способных создавать аудио переменной…

Daily · Stability AI · Stability AI

17 МАЯ

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Stability AI представила SAME (Semantically-Aligned Music Autoencoder) — открытый автоэнкодер, который призван изменить подходы к работе с музыкальными и общими аудиоданными. Его основная задача — эффективное сжатие…

14 МАЯ

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Deepgram представил обновление, которое меняет подход к цензурированию речи в транскрипциях: теперь функция фильтрации ненормативной лексики доступна для 50+ языков, охватывая широкий спектр мировых языков, а не только…

Daily · Recraft · Recraft

14 МАЯ

Recraft V4.1: Фотореализм стал естественнее, промты — короче

Recraft представил V4.1 — обновление своей модели, которое меняет подход к генерации изображений. Теперь фотореализм выглядит более живым и естественным, а для достижения желаемой эстетики требуются заметно более…

5 мин

13 МАЯ

Runway Agent: видео целиком за один диалог

Runway представила Runway Agent, креативного ИИ-партнера, который призван упростить процесс создания готового к публикации видеоконтента. От первоначальной идеи до финального ролика с несколькими сценами, озвучкой и…

01 МАЯ

Diffusers 0.38.0: Больше изображений, больше звука — и новые «мозги» для генерации

HuggingFace Diffusers, библиотека для работы с диффузионными моделями, получила масштабное обновление 0.38.0. В новой версии появились конвейеры для генерации изображений и аудио, среди которых заметны тяжеловесы с…

30 АПР

Gemini 3 Pro Image: когда промпт — это полотно, а референсов полдюжины

Runway выпустил новую модель для генерации изображений — Gemini 3 Pro Image. Она же Nano Banana Pro, или gemini_image3_pro в API. Модель заточена под детализированные текстовые запросы и множество референсных…

29 АПР

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Deepgram выкатил flux-multilingual — свою модель разговорного распознавания речи в общедоступную версию. Это шаг к унификации: теперь одна модель поддерживает 10 языков, автоматически обнаруживает и переключает языки…

21 АПР

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

15 АПР

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

Daily · Recraft · Recraft

25 МАР

Recraft V4: как перестать «переинжиниривать» промпты и начать исследовать

Обычно работа с генеративными моделями изображений начинается с кропотливого подбора промпта: больше слов, больше уточнений, надежда на идеальный результат. Но креативный процесс редко так работает; обычно это…

02 МАР

Nano Banana Pro: обходит лимиты Google с резервной моделью

Генерация изображений с помощью nano-banana-pro теперь стала надежнее. Replicate представил механизм резервирования, который позволяет продолжить работу, даже если основной API Google достигнет своих лимитов. Это…

Daily · Recraft · Recraft

17 ФЕВ

Recraft V4: когда дизайн-вкус модели важнее, чем просто генерация

Recraft представил новую итерацию своей модели генерации изображений, recraft-v4. Вместо универсального подхода, который часто приводит к «сток-дизайну», команда сфокусировалась на тонких аспектах визуальной эстетики…

10 ФЕВ

Runway: $315 млн на «модели мира» и Gen-4.5 в API

Runway привлекла 315 миллионов долларов в рамках финансирования Серии E для ускорения разработки так называемых «модели мира». Эти инвестиции пойдут на тренировку следующего поколения фундаментальных AI, которые могут…

Daily · Stability AI · Stability AI

19 НОЯ

Stable Audio: Warner Music Group и Stability AI создадут этичный AI для музыки

Warner Music Group и Stability AI объявили о партнёрстве, цель которого — разработка нового поколения инструментов для создания музыки с использованием ответственного подхода к искусственному интеллекту. Этот союз…