AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

10 ИЮН

Daily · Deepgram · Deepgram · TG #492

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Новый параметр diarize_model даёт явный контроль над версией — старые интеграции не ломаются, цена не меняется.

1 мин

04 ИЮН

Daily · Tencent · Tencent Hunyuan · TG #450

Sculpt4D от Tencent ARC генерирует 4D-объекты из видео — на 56% дешевле полного внимания

Модель надстроена над Hunyuan3D 2.1 и уже открыта на Hugging Face — но время инференса и лицензия не раскрыты.

1 мин

29 МАЯ

Daily · Deepgram · Deepgram

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram обновила свою специализированную модель Nova-3 Medical, значительно повысив точность распознавания медицинских терминов и сохранив качество для общего языка.

6 мин

28 МАЯ

Daily · Deepgram · Deepgram · TG #336

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Майский релиз Deepgram Self-Hosted 2026 года привносит расширенную фильтрацию ненормативной лексики и повышенную точность для корейского языка, а также важные изменения для будущих архитектурных обновлений движка.

6 мин

27 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Deepgram интегрировал модель Gemini 3.5 Flash в Voice Agent API, требуя от пользователей Gemini 2.5 Flash мигрировать до октября из-за предстоящего прекращения поддержки.

6 мин

19 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram объявил о доступности Gemini 3.1 Flash Lite в своём Voice Agent API, который теперь полностью управляем Google. Это означает, что предварительная версия модели устаревает, и всем пользователям предстоит…

1 мин

14 МАЯ

Daily · Deepgram · Deepgram

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Deepgram представил обновление, которое меняет подход к цензурированию речи в транскрипциях: теперь функция фильтрации ненормативной лексики доступна для 50+ языков, охватывая широкий спектр мировых языков, а не только…

4 мин

14 МАЯ

Daily · Tencent · Tencent Hunyuan

StereoCrafter2: Tencent ARC Lab обновила модель для иммерсивного видео

Tencent ARC Lab выпустила обновление своей модели StereoCrafter, получившее название StereoCrafter2. Новая версия нацелена на решение ключевой проблемы в производстве иммерсивного видео: достижение высокой точности и…

1 мин

11 МАЯ

Daily · Tencent · Tencent Hunyuan

Hy-MT2: многоязычный перевод для сложных сценариев — с оптимизацией для устройств

Tencent Hunyuan выпустила семейство многоязычных моделей перевода Hy-MT2, разработанных для сложных реальных сценариев. Модели доступны в размерах 1.8B, 7B и 30B-A3B (MoE), поддерживают 33 языка и демонстрируют…

3 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

01 МАЯ

Daily · Tencent · Tencent Hunyuan

Pixal3D-D от Tencent: 3D-модель представлена без документации

Tencent ARC Lab представила Pixal3D-D — новую модель для 3D-генерации, которая появилась на Hugging Face. Однако, несмотря на релиз, публичной документации или детального описания, как это часто бывает, пока нет.

1 мин

29 АПР

Daily · Deepgram · Deepgram

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Deepgram выкатил flux-multilingual — свою модель разговорного распознавания речи в общедоступную версию. Это шаг к унификации: теперь одна модель поддерживает 10 языков, автоматически обнаруживает и переключает языки…

6 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

23 АПР

Daily · Tencent · Tencent Hunyuan

Формат координат и ответа:

Точка: (x, y) или [(x1, y1), (x2, y2)] Коробка: [xmin, ymin, xmax, ymax] Координаты нормализованы до целочисленного диапазона (0, 1000). В режиме thinking mode ответы структурированы как…

1 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

26 МАР

Daily · Suno · Suno

Suno v5.5: модель учится вашему голосу и стилю

Suno выпустила версию модели v5.5, сделав акцент на персонализацию и выразительность. Основные нововведения — функции, которые позволяют пользователям захватывать и использовать собственный голос в генерации музыки…

2 мин

04 МАР

Daily · Perplexity · Perplexity

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Perplexity выпустила в общий доступ (GA) свои Agent API и Embeddings API. Это означает, что разработчики теперь могут использовать инструменты для создания автономных агентов и внедрения продвинутого семантического…

1 мин

06 ФЕВ

Daily · Suno · Suno

Suno Studio: больше контроля над музыкой без выхода из редактора

В мире, где AI-инструменты для создания музыки множатся, главная ставка — на контроль над результатом. Suno Studio, генеративная аудио рабочая станция, доступная подписчикам Suno Premier, сделала шаг именно в этом…

2 мин

25 НОЯ

Daily · Suno · Suno

Suno и Warner Music Group: лицензирование музыки ради «интерактивного будущего»

Сервис генерации музыки Suno объявил о заключении партнерства с Warner Music Group (WMG). Этот шаг означает, что Suno получит доступ к лицензированной музыке для обучения своих моделей, что, по заявлению компании…

2 мин

Новости AI-стека

Daily · свежие материалы

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Sculpt4D от Tencent ARC генерирует 4D-объекты из видео — на 56% дешевле полного внимания

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

StereoCrafter2: Tencent ARC Lab обновила модель для иммерсивного видео

Hy-MT2: многоязычный перевод для сложных сценариев — с оптимизацией для устройств

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Pixal3D-D от Tencent: 3D-модель представлена без документации

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

**Формат координат и ответа:**

Agent API Perplexity: новые модели и прощание со старыми Gemini

Suno v5.5: модель учится вашему голосу и стилю

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Suno Studio: больше контроля над музыкой без выхода из редактора

Suno и Warner Music Group: лицензирование музыки ради «интерактивного будущего»

Замечания по сайту

Формат координат и ответа: