AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

10 ИЮН

Daily · Deepgram · Deepgram · TG #492

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Новый параметр diarize_model даёт явный контроль над версией — старые интеграции не ломаются, цена не меняется.

1 мин

10 ИЮН

Daily · Google · Google · TG #489

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

18 ГБ VRAM и Apache 2.0 — но качество ниже Gemma 4, и на Apple Silicon ускорения нет.

2 мин

09 ИЮН

Daily · Google · Google · TG #477

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Первая модель среднего размера от Google с нативным аудиовходом: 16 ГБ VRAM, Apache 2.0 — и бенчмарки близко к 26B MoE.

1 мин

03 ИЮН

Daily · Stability AI · Stability AI · TG #441

Stability AI нашла способ экономить память при длинных текстах и видео

Новый метод сжимает промежуточные данные модели так, что та работает быстрее и не тормозит при обработке больших объёмов.

1 мин

01 ИЮН

Daily · Google · Google

Gemini 2.0 Flash отключён — что ставить вместо него

1 июня 2026 г. Google отключила четыре модели Gemini 2.0 Flash в Gemini API — любой вызов к этим эндпоинтам теперь падает, и нужна явная миграция. Примечательно здесь не само отключение, а то, куда ведут замены: не в…

1 мин

29 МАЯ

Daily · Deepgram · Deepgram

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram обновила свою специализированную модель Nova-3 Medical, значительно повысив точность распознавания медицинских терминов и сохранив качество для общего языка.

6 мин

28 МАЯ

Daily · Deepgram · Deepgram · TG #336

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Майский релиз Deepgram Self-Hosted 2026 года привносит расширенную фильтрацию ненормативной лексики и повышенную точность для корейского языка, а также важные изменения для будущих архитектурных обновлений движка.

6 мин

28 МАЯ

Daily · Google · Google

Gemini Image Models: видео в картинку, но не для всех

Google представила обновленную линейку моделей Nano Banana для генерации и редактирования изображений, а также расширила функции понимания видеоконтента, открывая мультимодальные возможности для разработчиков.

7 мин

27 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Deepgram интегрировал модель Gemini 3.5 Flash в Voice Agent API, требуя от пользователей Gemini 2.5 Flash мигрировать до октября из-за предстоящего прекращения поддержки.

6 мин

26 МАЯ

Daily · Google · Google

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google консолидирует все ИИ-сервисы Vertex AI в унифицированной Gemini Enterprise Agent Platform, фокусируясь на комплексной разработке и управлении корпоративными агентами.

7 мин

22 МАЯ

Daily · DeepSeek · X · DeepSeek

DeepSeek-V4-Pro: дисконт, ставший бессрочным

DeepSeek объявила, что скидка на использование модели DeepSeek-V4-Pro теперь действует постоянно. Это не временная акция, а фундаментальное изменение в ценовой политике, позволяющее разработчикам с большей уверенностью…

1 мин

21 МАЯ

Daily · Google · Google

Google DeepMind Accelerator: AI против климатических рисков в АТР

Google DeepMind запускает Google DeepMind Accelerator — трехмесячную программу, сфокусированную на инициативе «AI for the Planet». Этот акселератор ориентирован на поддержку инноваторов в Азиатско-Тихоокеанском регионе…

2 мин

19 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram объявил о доступности Gemini 3.1 Flash Lite в своём Voice Agent API, который теперь полностью управляем Google. Это означает, что предварительная версия модели устаревает, и всем пользователям предстоит…

1 мин

18 МАЯ

Daily · Stability AI · Stability AI

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI выпустила Stable Audio 3 — новую открытую модель для генерации и редактирования аудио. Эта модель представляет собой семейство быстрых латентных диффузионных моделей, способных создавать аудио переменной…

3 мин

17 МАЯ

Daily · Stability AI · Stability AI

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Stability AI представила SAME (Semantically-Aligned Music Autoencoder) — открытый автоэнкодер, который призван изменить подходы к работе с музыкальными и общими аудиоданными. Его основная задача — эффективное сжатие…

3 мин

14 МАЯ

Daily · Deepgram · Deepgram

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Deepgram представил обновление, которое меняет подход к цензурированию речи в транскрипциях: теперь функция фильтрации ненормативной лексики доступна для 50+ языков, охватывая широкий спектр мировых языков, а не только…

4 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

06 МАЯ

Daily · AssemblyAI · AssemblyAI

AssemblyAI: когда JSON самоисправляется, а голоса чётко делятся по словам

Работа с моделями в продакшене всегда подразумевает компромиссы: LLM могут «глючить» с JSON-форматом, а аудиомодели — неточно разделять голоса в потоке. На этой неделе AssemblyAI показала два обновления, которые решают…

2 мин

06 МАЯ

Daily · Google · Google

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Google анонсировал ломающее изменение в Gemini Interactions API: схема outputs→steps и response_format меняются, новая дефолтная 26 мая, старую удаляют 8 июня. И это не первый раз — API ломали ещё в декабре. Рядом …

3 мин

29 АПР

Daily · AssemblyAI · AssemblyAI

Voice Agent API: «позвонилка» с LLM-мозгом в один WebSocket

AssemblyAI Voice Agent API — это единый конвейер для создания голосовых агентов, который умеет понимать речь, рассуждать на базе LLM и генерировать голос. Он упакован в один WebSocket и позволяет обойтись без сложной…

2 мин

29 АПР

Daily · Deepgram · Deepgram

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Deepgram выкатил flux-multilingual — свою модель разговорного распознавания речи в общедоступную версию. Это шаг к унификации: теперь одна модель поддерживает 10 языков, автоматически обнаруживает и переключает языки…

6 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

25 АПР

Daily · AssemblyAI · AssemblyAI

PII Redaction: два транскрипта в одном запросе — удобно для UI, но не без подвоха

Соблюдение конфиденциальности данных и обеспечение полноты информации часто идут рука об руку с компромиссами. Например, когда PII Redaction скрывает персональные данные в транскриптах, это хорошо для безопасности, но…

2 мин

24 АПР

Daily · DeepSeek · DeepSeek

DeepSeek: V4-модели с контекстом 1M токенов и деприкация старых API

DeepSeek обновил свой API, представив новое поколение моделей с увеличенным контекстом и объявив о скором прекращении поддержки старых версий. Разработчикам, использующим DeepSeek, предстоит запланировать миграцию.

1 мин

22 АПР

Daily · Google · Google

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Модель внедрения gemini-embedding-2 достигла статуса общей доступности (GA), что делает её готовой для продакшен-нагрузок и интеграции в полноценные приложения. Это событие совпало с презентацией Google DeepMind новой…

3 мин

22 АПР

Daily · DeepSeek · DeepSeek

DeepSeek-V4: Контекст в 1M токенов и гибридная архитектура внимания

DeepSeek AI представила новую серию моделей DeepSeek-V4, включая DeepSeek-V4-Pro и DeepSeek-V4-Flash. Главная особенность обеих версий — поддержка контекстного окна в один миллион токенов, что переводит их в лигу…

3 мин

19 АПР

Daily · AssemblyAI · AssemblyAI

Claude Opus 4.7 на LLM Gateway AssemblyAI: доступ к интеллекту Anthropic

AssemblyAI, известный своей платформой для работы с аудио, добавил поддержку новейшей модели Claude Opus 4.7 в свой LLM Gateway. Это значит, что инженеры теперь могут использовать одну из самых интеллектуальных моделей…

1 мин

15 АПР

Daily · Google · Google

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Google выкатил в preview Gemini 3.1 Flash TTS. Раньше синтез речи — «выбери голос из списка». Теперь голосом управляют как режиссёр актёром, указаниями прямо в тексте через аудиометки, а найденную постановку можно…

2 мин

14 АПР

Daily · Google · Google

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Google расширяет свою AI-инфраструктуру, предлагая как новые возможности для сторонних моделей, так и улучшения для собственных. На этой неделе стал доступен Claude Opus 4.7 в Vertex AI Model Garden, предоставляя…

2 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

Новости AI-стека

Daily · свежие материалы

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Stability AI нашла способ экономить память при длинных текстах и видео

Gemini 2.0 Flash отключён — что ставить вместо него

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Gemini Image Models: видео в картинку, но не для всех

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

DeepSeek-V4-Pro: дисконт, ставший бессрочным

Google DeepMind Accelerator: AI против климатических рисков в АТР

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

AssemblyAI: когда JSON самоисправляется, а голоса чётко делятся по словам

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Voice Agent API: «позвонилка» с LLM-мозгом в один WebSocket

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

PII Redaction: два транскрипта в одном запросе — удобно для UI, но не без подвоха

DeepSeek: V4-модели с контекстом 1M токенов и деприкация старых API

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

DeepSeek-V4: Контекст в 1M токенов и гибридная архитектура внимания

Claude Opus 4.7 на LLM Gateway AssemblyAI: доступ к интеллекту Anthropic

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Agent API Perplexity: новые модели и прощание со старыми Gemini

Замечания по сайту