AI/News — anthropic ecosystem newsroom

Together AI раскрыла инженерные решения, позволившие обслуживать MiniMax M3 (1M токенов, нативная мультимодальность, MSA-архитектура) с приростом throughput 81–125% на разных уровнях конкурентности. Это первый публичный…

2 мин

02 ИЮН

Daily · Replicate · Replicate

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Google · Google

Gemini 2.0 Flash отключён — что ставить вместо него

1 июня 2026 г. Google отключила четыре модели Gemini 2.0 Flash в Gemini API — любой вызов к этим эндпоинтам теперь падает, и нужна явная миграция. Примечательно здесь не само отключение, а то, куда ведут замены: не в…

1 мин

01 ИЮН

Daily · Luma AI · Luma AI

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

Luma объявила об Open Physical AI Lab — исследовательской инициативе с открытым доступом, нацеленной на проблему обобщения в физическом ИИ. Компания считает её главным барьером между нынешними роботами и системами…

1 мин

29 МАЯ

Daily · ElevenLabs · X · ElevenLabs

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, отметил в своем посте X впечатляющую способность Gemini Omni обрабатывать отражения.

1 мин

29 МАЯ

Daily · Together AI · Together AI

Together AI: как построить рекордно быстрый Speech-to-Text стек

Together AI представила детальное техническое описание оптимизации всего стека преобразования речи в текст, включая GPU, CPU, память и сетевые протоколы, установив новый мировой рекорд скорости.

8 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

Торстен Шефф разрабатывает прототип решения для формирования команд на аутригерах прямо во время полета, демонстрируя потенциал быстрой разработки с агентивными ИИ-инструментами.

8 мин

28 МАЯ

Daily · Google · Google

Gemini Image Models: видео в картинку, но не для всех

Google представила обновленную линейку моделей Nano Banana для генерации и редактирования изображений, а также расширила функции понимания видеоконтента, открывая мультимодальные возможности для разработчиков.

7 мин

27 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Разработчик Google Торстен Шафф приступил к созданию ИИ-помощника для гребли на каноэ с помощью Gemini 3.5 Flash и Antigravity прямо на борту самолета.

12 мин

26 МАЯ

Daily · Google · Google

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google консолидирует все ИИ-сервисы Vertex AI в унифицированной Gemini Enterprise Agent Platform, фокусируясь на комплексной разработке и управлении корпоративными агентами.

7 мин

22 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, активно участвовал в конференции Google I/O. Он продемонстрировал возможности интеграции multimodal-file-search и vision-agents для создания…

2 мин

21 МАЯ

Daily · Google · Google

Google DeepMind Accelerator: AI против климатических рисков в АТР

Google DeepMind запускает Google DeepMind Accelerator — трехмесячную программу, сфокусированную на инициативе «AI for the Planet». Этот акселератор ориентирован на поддержку инноваторов в Азиатско-Тихоокеанском регионе…

2 мин

20 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs: намек на Google I/O и «прогретые TPU»

ElevenLabs, известная своими технологиями синтеза речи, через своего руководителя по работе с разработчиками Торстена Шеффа сделала загадочный анонс в X, подогревая интерес к предстоящему мероприятию Google I/O…

1 мин

18 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Взгляд изнутри ElevenLabs

Сегодняшний день не принес крупных анонсов или обновлений от ElevenLabs. Вместо этого, фокус сместился на внутренние события и личные наблюдения сотрудников, что дает редкую возможность заглянуть за кулисы повседневной…

1 мин

15 МАЯ

Daily · Together AI · Together AI

Gemma-4-31B-it-pearl: как крипто-майнинг удешевляет инференс AI

Together AI объединяет усилия с Pearl Research Labs, чтобы радикально изменить экономику инференса AI. В основе нового партнёрства лежит технология Proof of Useful Work, которая позволяет одновременно с вычислениями для…

3 мин

14 МАЯ

Daily · Together AI · Together AI

violin: Открытый AI-перевод видео, который уважает голоса

Together AI выпустила Violin — полностью открытый инструмент для перевода видео, который разрушает языковые барьеры. Это комплексное решение объединяет распознавание речи, крупномодельный перевод и синтез речи, а также…

3 мин

13 МАЯ

Daily · ElevenLabs · ElevenLabs

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

ElevenLabs выпустила набор обновлений, затрагивающих как инструментарий для работы с агентами, так и базовые API. Среди наиболее заметных изменений — появление детализированных SIP-логов для отладки, новый API для…

2 мин

12 МАЯ

Daily · Together AI · Together AI

Voice Finder от Together AI: 600 голосов теперь можно искать по запросу

Together AI представила новый инструмент Voice Finder, который должен упростить процесс подбора подходящего голоса для приложений. Разработчики теперь смогут использовать естественный язык или аудиосэмплы для навигации…

10 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

Новости AI-стека

Daily · свежие материалы

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

ElevenLabs открыл API для разработчиков по всему миру — Grab уже тестирует

Ray3.2 от Luma: покадровое управление видео и первый полноценный API

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Один API-запрос — и агент ElevenLabs сам снял видео

ElevenLabs показала, как создать приложение голосом

Replicate устранил очереди и задержки на кластерах L40S и H200

Luma Ray3.14 заменил захват движений на живом выступлении в Париже

Reachy Mini заговорил без облака: Parakeet + Gemma 4 E4B + Qwen3TTS на борту

Как Together AI запустила 1M-контекст MiniMax M3 в продакшне без деградации throughput

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

Gemini 2.0 Flash отключён — что ставить вместо него

Luma открывает Physical AI Lab: ставка на открытую науку против монополии в робототехнике

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Together AI: как построить рекордно быстрый Speech-to-Text стек

Cog: потоки событий для предсказаний и новые предупреждения

Снижение производительности flux-2-klein-4b

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

Gemini Image Models: видео в картинку, но не для всех

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Google DeepMind Accelerator: AI против климатических рисков в АТР

ElevenLabs: намек на Google I/O и «прогретые TPU»

Взгляд изнутри ElevenLabs

Gemma-4-31B-it-pearl: как крипто-майнинг удешевляет инференс AI

violin: Открытый AI-перевод видео, который уважает голоса

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

Voice Finder от Together AI: 600 голосов теперь можно искать по запросу

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Замечания по сайту