AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

10 ИЮН

Daily · Deepgram · Deepgram · TG #492

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Новый параметр diarize_model даёт явный контроль над версией — старые интеграции не ломаются, цена не меняется.

1 мин

09 ИЮН

Daily · Luma AI · Luma AI · TG #480

Ray3.2 от Luma: покадровое управление видео и первый полноценный API

До 16 кейфреймов в одном клипе и 16-bit EXR на выходе — впервые всё это доступно через API; 5 секунд в 1080p стоят $1.20.

2 мин

08 ИЮН

Daily · Alibaba · Alibaba · TG #465

Qwen3.7-Plus видит экран, управляет GUI и пишет код — в одном агентном цикле

Входные токены — $0.40 за миллион, контекст — 1 млн токенов; работает из Claude Code, Cursor и Cline без дополнительной настройки.

2 мин

04 ИЮН

Daily · Black Forest Labs · Black Forest Labs · TG #446

FLUX.2 встроили в ноутбуки ASUS — без интернета и подписки

Модель генерирует изображения прямо на устройстве за 5 секунд — без облака и без платы за каждый запрос.

1 мин

03 ИЮН

Daily · Stability AI · Stability AI · TG #441

Stability AI нашла способ экономить память при длинных текстах и видео

Новый метод сжимает промежуточные данные модели так, что та работает быстрее и не тормозит при обработке больших объёмов.

1 мин

03 ИЮН

Daily · Replicate · Replicate · TG #440

Replicate устранил очереди и задержки на кластерах L40S и H200

Конкуренция за модели замедляла запуски — теперь система работает штатно.

1 мин

03 ИЮН

Daily · Luma AI · Luma AI · TG #437

Luma Ray3.14 заменил захват движений на живом выступлении в Париже

Модель в 4 раза быстрее и в 3 раза дешевле предшественника — теперь в руках независимых авторов.

1 мин

03 ИЮН

Daily · Alibaba · Alibaba

Qwen App открылся для сторонних агентов: KFC, Luckin Coffee и Mixue первыми в очереди

100 млн ежедневных взаимодействий и долгосрочная память агентов — что это значит для брендов-интеграторов.

2 мин

02 ИЮН

Daily · Replicate · Replicate

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Luma AI · Luma AI

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

Luma объявила об Open Physical AI Lab — исследовательской инициативе с открытым доступом, нацеленной на проблему обобщения в физическом ИИ. Компания считает её главным барьером между нынешними роботами и системами…

1 мин

01 ИЮН

Daily · Alibaba · Alibaba

Quick BI против галлюцинирующих агентов: почему данные важнее модели

На конференции Qwen в Сингапуре 26 мая 2026 года Lingyang показала Quick BI с одного конкретного факта: три разных корпоративных агента дают три разных определения «выручки», и никто в компании не решается принять…

2 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

29 МАЯ

Daily · Deepgram · Deepgram

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram обновила свою специализированную модель Nova-3 Medical, значительно повысив точность распознавания медицинских терминов и сохранив качество для общего языка.

6 мин

29 МАЯ

Daily · Alibaba · Alibaba · TG #331

Qwen-VLA: От осмысления к активному вмешательству в реальный мир

Alibaba представила Qwen-VLA — мультимодальную модель, способную не только понимать визуальные данные, но и действовать в физическом мире.

10 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · Black Forest Labs · Black Forest Labs

FLUX VTO: виртуальная примерка в масштабе каталога

Black Forest Labs анонсировала FLUX VTO — новую технологию виртуальной примерки одежды, предназначенную для ритейлеров, которая обеспечивает высокую скорость, точность рендеринга и гибкость стилизации для больших…

7 мин

28 МАЯ

Daily · Deepgram · Deepgram · TG #336

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Майский релиз Deepgram Self-Hosted 2026 года привносит расширенную фильтрацию ненормативной лексики и повышенную точность для корейского языка, а также важные изменения для будущих архитектурных обновлений движка.

6 мин

28 МАЯ

Daily · Alibaba · Alibaba

qwen-cloud: облако, где агенты говорят на одном языке

Alibaba Cloud представила Qwen Cloud 26 мая в Сингапуре, создав AI-нативную платформу для работы с агентами и мультимодальными моделями.

10 мин

27 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Deepgram интегрировал модель Gemini 3.5 Flash в Voice Agent API, требуя от пользователей Gemini 2.5 Flash мигрировать до октября из-за предстоящего прекращения поддержки.

6 мин

27 МАЯ

Daily · Alibaba · Alibaba

Alibaba Cloud: комплексная экосистема для агентного ИИ и глобального масштаба

На первой международной конференции Qwen в Сингапуре Alibaba Cloud представила новые модели, инфраструктуру и инструменты для построения и управления ИИ-агентами.

9 мин

25 МАЯ

Daily · Alibaba · Alibaba

qwen3: гибридные рассуждения и сотни миллионов загрузок

Alibaba представила Qwen3 — новое поколение своих открытых больших языковых моделей, вводя гибридные режимы рассуждений и расширяя возможности агентов и многоязычной поддержки.

7 мин

22 МАЯ

Daily · DeepSeek · X · DeepSeek

DeepSeek-V4-Pro: дисконт, ставший бессрочным

DeepSeek объявила, что скидка на использование модели DeepSeek-V4-Pro теперь действует постоянно. Это не временная акция, а фундаментальное изменение в ценовой политике, позволяющее разработчикам с большей уверенностью…

1 мин

22 МАЯ

Daily · Alibaba · Alibaba

qwen3.5-livetranslate-Flash: Переводит речь, видит контекст, клонирует голос

Alibaba выпустила qwen3.5-livetranslate-Flash, новейшую модель синхронного перевода, которая не просто слушает и переводит речь, но и понимает визуальный контекст. Эта многомодальная система, построенная на архитектуре…

4 мин

19 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram объявил о доступности Gemini 3.1 Flash Lite в своём Voice Agent API, который теперь полностью управляем Google. Это означает, что предварительная версия модели устаревает, и всем пользователям предстоит…

1 мин

19 МАЯ

Daily · Alibaba · Alibaba

Qwen3.7-Max: Модель для агентов и перевод, который видит

Alibaba представила две новые модели: Qwen3.7-Max, ориентированную на автономных агентов, и Qwen3.5-LiveTranslate-Flash, способную к синхронному переводу с учетом визуального контекста. Это развитие AI-возможностей…

3 мин

18 МАЯ

Daily · Stability AI · Stability AI

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI выпустила Stable Audio 3 — новую открытую модель для генерации и редактирования аудио. Эта модель представляет собой семейство быстрых латентных диффузионных моделей, способных создавать аудио переменной…

3 мин

17 МАЯ

Daily · Stability AI · Stability AI

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Stability AI представила SAME (Semantically-Aligned Music Autoencoder) — открытый автоэнкодер, который призван изменить подходы к работе с музыкальными и общими аудиоданными. Его основная задача — эффективное сжатие…

3 мин

14 МАЯ

Daily · Deepgram · Deepgram

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Deepgram представил обновление, которое меняет подход к цензурированию речи в транскрипциях: теперь функция фильтрации ненормативной лексики доступна для 50+ языков, охватывая широкий спектр мировых языков, а не только…

4 мин

14 МАЯ

Daily · Black Forest Labs · Black Forest Labs

FLUX Outpainting: ИИ-расширение изображений в один API-вызов, без промтов

Black Forest Labs представила новую возможность для своей линейки FLUX Tools — FLUX Outpainting. Инструмент позволяет расширять любое изображение за его исходные границы, автоматически сохраняя при этом целостность…

3 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

Новости AI-стека

Daily · свежие материалы

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Ray3.2 от Luma: покадровое управление видео и первый полноценный API

Qwen3.7-Plus видит экран, управляет GUI и пишет код — в одном агентном цикле

FLUX.2 встроили в ноутбуки ASUS — без интернета и подписки

Stability AI нашла способ экономить память при длинных текстах и видео

Replicate устранил очереди и задержки на кластерах L40S и H200

Luma Ray3.14 заменил захват движений на живом выступлении в Париже

Qwen App открылся для сторонних агентов: KFC, Luckin Coffee и Mixue первыми в очереди

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

Quick BI против галлюцинирующих агентов: почему данные важнее модели

Cog: потоки событий для предсказаний и новые предупреждения

Nova-3 Medical: точность в медицине растет, но что с остальным?

Qwen-VLA: От осмысления к активному вмешательству в реальный мир

Снижение производительности flux-2-klein-4b

FLUX VTO: виртуальная примерка в масштабе каталога

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

qwen-cloud: облако, где агенты говорят на одном языке

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Alibaba Cloud: комплексная экосистема для агентного ИИ и глобального масштаба

qwen3: гибридные рассуждения и сотни миллионов загрузок

DeepSeek-V4-Pro: дисконт, ставший бессрочным

qwen3.5-livetranslate-Flash: Переводит речь, видит контекст, клонирует голос

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Qwen3.7-Max: Модель для агентов и перевод, который видит

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

FLUX Outpainting: ИИ-расширение изображений в один API-вызов, без промтов

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Замечания по сайту