AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

10 ИЮН

Daily · Google · Google · TG #489

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

18 ГБ VRAM и Apache 2.0 — но качество ниже Gemma 4, и на Apple Silicon ускорения нет.

2 мин

09 ИЮН

Daily · ElevenLabs · X · ElevenLabs · TG #485

ElevenLabs открыл API для разработчиков по всему миру — Grab уже тестирует

Географических ограничений больше нет — и первый публичный кейс пришёл из Юго-Восточной Азии.

1 мин

09 ИЮН

Daily · Luma AI · Luma AI · TG #480

Ray3.2 от Luma: покадровое управление видео и первый полноценный API

До 16 кейфреймов в одном клипе и 16-bit EXR на выходе — впервые всё это доступно через API; 5 секунд в 1080p стоят $1.20.

2 мин

09 ИЮН

Daily · Google · Google · TG #477

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Первая модель среднего размера от Google с нативным аудиовходом: 16 ГБ VRAM, Apache 2.0 — и бенчмарки близко к 26B MoE.

1 мин

08 ИЮН

Daily · ElevenLabs · X · ElevenLabs · TG #475

Один API-запрос — и агент ElevenLabs сам снял видео

Агент исследует тему, пишет HTML/CSS и рендерит MP4 через HyperFrames — без ручного монтажа.

1 мин

08 ИЮН

Daily · Alibaba · Alibaba · TG #465

Qwen3.7-Plus видит экран, управляет GUI и пишет код — в одном агентном цикле

Входные токены — $0.40 за миллион, контекст — 1 млн токенов; работает из Claude Code, Cursor и Cline без дополнительной настройки.

2 мин

04 ИЮН

Daily · Black Forest Labs · Black Forest Labs · TG #446

FLUX.2 встроили в ноутбуки ASUS — без интернета и подписки

Модель генерирует изображения прямо на устройстве за 5 секунд — без облака и без платы за каждый запрос.

1 мин

03 ИЮН

Daily · ElevenLabs · X · ElevenLabs · TG #444

ElevenLabs показала, как создать приложение голосом

Вы голосом описываете, что хотите, — а система сама собирает готовое приложение под ваш запрос.

1 мин

03 ИЮН

Daily · Stability AI · Stability AI · TG #441

Stability AI нашла способ экономить память при длинных текстах и видео

Новый метод сжимает промежуточные данные модели так, что та работает быстрее и не тормозит при обработке больших объёмов.

1 мин

03 ИЮН

Daily · Replicate · Replicate · TG #440

Replicate устранил очереди и задержки на кластерах L40S и H200

Конкуренция за модели замедляла запуски — теперь система работает штатно.

1 мин

03 ИЮН

Daily · Luma AI · Luma AI · TG #437

Luma Ray3.14 заменил захват движений на живом выступлении в Париже

Модель в 4 раза быстрее и в 3 раза дешевле предшественника — теперь в руках независимых авторов.

1 мин

03 ИЮН

Daily · Alibaba · Alibaba

Qwen App открылся для сторонних агентов: KFC, Luckin Coffee и Mixue первыми в очереди

100 млн ежедневных взаимодействий и долгосрочная память агентов — что это значит для брендов-интеграторов.

2 мин

02 ИЮН

Daily · ElevenLabs · X · ElevenLabs

Reachy Mini заговорил без облака: Parakeet + Gemma 4 E4B + Qwen3TTS на борту

Как три open-source модели складываются в полный голосовой цикл на $300 роботе.

1 мин

02 ИЮН

Daily · Replicate · Replicate

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Google · Google

Gemini 2.0 Flash отключён — что ставить вместо него

1 июня 2026 г. Google отключила четыре модели Gemini 2.0 Flash в Gemini API — любой вызов к этим эндпоинтам теперь падает, и нужна явная миграция. Примечательно здесь не само отключение, а то, куда ведут замены: не в…

1 мин

01 ИЮН

Daily · Luma AI · Luma AI

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

Luma объявила об Open Physical AI Lab — исследовательской инициативе с открытым доступом, нацеленной на проблему обобщения в физическом ИИ. Компания считает её главным барьером между нынешними роботами и системами…

1 мин

01 ИЮН

Daily · Alibaba · Alibaba

Quick BI против галлюцинирующих агентов: почему данные важнее модели

На конференции Qwen в Сингапуре 26 мая 2026 года Lingyang показала Quick BI с одного конкретного факта: три разных корпоративных агента дают три разных определения «выручки», и никто в компании не решается принять…

2 мин

29 МАЯ

Daily · ElevenLabs · X · ElevenLabs

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, отметил в своем посте X впечатляющую способность Gemini Omni обрабатывать отражения.

1 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

29 МАЯ

Daily · Alibaba · Alibaba · TG #331

Qwen-VLA: От осмысления к активному вмешательству в реальный мир

Alibaba представила Qwen-VLA — мультимодальную модель, способную не только понимать визуальные данные, но и действовать в физическом мире.

10 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

Торстен Шефф разрабатывает прототип решения для формирования команд на аутригерах прямо во время полета, демонстрируя потенциал быстрой разработки с агентивными ИИ-инструментами.

8 мин

28 МАЯ

Daily · Black Forest Labs · Black Forest Labs

FLUX VTO: виртуальная примерка в масштабе каталога

Black Forest Labs анонсировала FLUX VTO — новую технологию виртуальной примерки одежды, предназначенную для ритейлеров, которая обеспечивает высокую скорость, точность рендеринга и гибкость стилизации для больших…

7 мин

28 МАЯ

Daily · Google · Google

Gemini Image Models: видео в картинку, но не для всех

Google представила обновленную линейку моделей Nano Banana для генерации и редактирования изображений, а также расширила функции понимания видеоконтента, открывая мультимодальные возможности для разработчиков.

7 мин

28 МАЯ

Daily · Alibaba · Alibaba

qwen-cloud: облако, где агенты говорят на одном языке

Alibaba Cloud представила Qwen Cloud 26 мая в Сингапуре, создав AI-нативную платформу для работы с агентами и мультимодальными моделями.

10 мин

27 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Разработчик Google Торстен Шафф приступил к созданию ИИ-помощника для гребли на каноэ с помощью Gemini 3.5 Flash и Antigravity прямо на борту самолета.

12 мин

27 МАЯ

Daily · Alibaba · Alibaba

Alibaba Cloud: комплексная экосистема для агентного ИИ и глобального масштаба

На первой международной конференции Qwen в Сингапуре Alibaba Cloud представила новые модели, инфраструктуру и инструменты для построения и управления ИИ-агентами.

9 мин

26 МАЯ

Daily · Google · Google

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google консолидирует все ИИ-сервисы Vertex AI в унифицированной Gemini Enterprise Agent Platform, фокусируясь на комплексной разработке и управлении корпоративными агентами.

7 мин

25 МАЯ

Daily · Alibaba · Alibaba

qwen3: гибридные рассуждения и сотни миллионов загрузок

Alibaba представила Qwen3 — новое поколение своих открытых больших языковых моделей, вводя гибридные режимы рассуждений и расширяя возможности агентов и многоязычной поддержки.

7 мин

22 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, активно участвовал в конференции Google I/O. Он продемонстрировал возможности интеграции multimodal-file-search и vision-agents для создания…

2 мин

Новости AI-стека

Daily · свежие материалы

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

ElevenLabs открыл API для разработчиков по всему миру — Grab уже тестирует

Ray3.2 от Luma: покадровое управление видео и первый полноценный API

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Один API-запрос — и агент ElevenLabs сам снял видео

Qwen3.7-Plus видит экран, управляет GUI и пишет код — в одном агентном цикле

FLUX.2 встроили в ноутбуки ASUS — без интернета и подписки

ElevenLabs показала, как создать приложение голосом

Stability AI нашла способ экономить память при длинных текстах и видео

Replicate устранил очереди и задержки на кластерах L40S и H200

Luma Ray3.14 заменил захват движений на живом выступлении в Париже

Qwen App открылся для сторонних агентов: KFC, Luckin Coffee и Mixue первыми в очереди

Reachy Mini заговорил без облака: Parakeet + Gemma 4 E4B + Qwen3TTS на борту

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

Gemini 2.0 Flash отключён — что ставить вместо него

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

Quick BI против галлюцинирующих агентов: почему данные важнее модели

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Cog: потоки событий для предсказаний и новые предупреждения

Qwen-VLA: От осмысления к активному вмешательству в реальный мир

Снижение производительности flux-2-klein-4b

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

FLUX VTO: виртуальная примерка в масштабе каталога

Gemini Image Models: видео в картинку, но не для всех

qwen-cloud: облако, где агенты говорят на одном языке

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Alibaba Cloud: комплексная экосистема для агентного ИИ и глобального масштаба

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

qwen3: гибридные рассуждения и сотни миллионов загрузок

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Замечания по сайту