AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

10 ИЮН

Daily · Deepgram · Deepgram · TG #492

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Новый параметр diarize_model даёт явный контроль над версией — старые интеграции не ломаются, цена не меняется.

1 мин

03 ИЮН

Daily · Replicate · Replicate · TG #440

Replicate устранил очереди и задержки на кластерах L40S и H200

Конкуренция за модели замедляла запуски — теперь система работает штатно.

1 мин

02 ИЮН

Daily · Replicate · Replicate

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

29 МАЯ

Daily · Deepgram · Deepgram

Nova-3 Medical: точность в медицине растет, но что с остальным?

Deepgram обновила свою специализированную модель Nova-3 Medical, значительно повысив точность распознавания медицинских терминов и сохранив качество для общего языка.

6 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · Deepgram · Deepgram · TG #336

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Майский релиз Deepgram Self-Hosted 2026 года привносит расширенную фильтрацию ненормативной лексики и повышенную точность для корейского языка, а также важные изменения для будущих архитектурных обновлений движка.

6 мин

27 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

Deepgram интегрировал модель Gemini 3.5 Flash в Voice Agent API, требуя от пользователей Gemini 2.5 Flash мигрировать до октября из-за предстоящего прекращения поддержки.

6 мин

22 МАЯ

Daily · DeepSeek · X · DeepSeek

DeepSeek-V4-Pro: дисконт, ставший бессрочным

DeepSeek объявила, что скидка на использование модели DeepSeek-V4-Pro теперь действует постоянно. Это не временная акция, а фундаментальное изменение в ценовой политике, позволяющее разработчикам с большей уверенностью…

1 мин

19 МАЯ

Daily · Deepgram · Deepgram

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram объявил о доступности Gemini 3.1 Flash Lite в своём Voice Agent API, который теперь полностью управляем Google. Это означает, что предварительная версия модели устаревает, и всем пользователям предстоит…

1 мин

14 МАЯ

Daily · Deepgram · Deepgram

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Deepgram представил обновление, которое меняет подход к цензурированию речи в транскрипциях: теперь функция фильтрации ненормативной лексики доступна для 50+ языков, охватывая широкий спектр мировых языков, а не только…

4 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

29 АПР

Daily · Deepgram · Deepgram

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Deepgram выкатил flux-multilingual — свою модель разговорного распознавания речи в общедоступную версию. Это шаг к унификации: теперь одна модель поддерживает 10 языков, автоматически обнаруживает и переключает языки…

6 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

24 АПР

Daily · DeepSeek · DeepSeek

DeepSeek: V4-модели с контекстом 1M токенов и деприкация старых API

DeepSeek обновил свой API, представив новое поколение моделей с увеличенным контекстом и объявив о скором прекращении поддержки старых версий. Разработчикам, использующим DeepSeek, предстоит запланировать миграцию.

1 мин

22 АПР

Daily · DeepSeek · DeepSeek

DeepSeek-V4: Контекст в 1M токенов и гибридная архитектура внимания

DeepSeek AI представила новую серию моделей DeepSeek-V4, включая DeepSeek-V4-Pro и DeepSeek-V4-Flash. Главная особенность обеих версий — поддержка контекстного окна в один миллион токенов, что переводит их в лигу…

3 мин

21 АПР

Daily · Replicate · Replicate

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

2 мин

18 АПР

Daily · Groq · Groq

Groq расширяет выбор моделей: два новых LLM для Enterprise и голоса Orpheus

Groq усиливает свою платформу, добавляя две новые крупные языковые модели, доступные для корпоративных клиентов, и обогащает возможности синтеза речи новыми голосами. Это обновление направлено на предоставление более…

3 мин

15 АПР

Daily · Replicate · Replicate

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

4 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

09 АПР

Daily · Groq · Groq

Orpheus TTS на GroqCloud: арабский акцент и голосовые команды для реального времени

На GroqCloud теперь доступен Orpheus TTS от Canopy Labs — движок синтеза речи, заточенный под сценарии с низкой задержкой, где скорость ответа и естественность голоса имеют решающее значение. Этот сервис предлагает…

3 мин

04 МАР

Daily · Perplexity · Perplexity

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Perplexity выпустила в общий доступ (GA) свои Agent API и Embeddings API. Это означает, что разработчики теперь могут использовать инструменты для создания автономных агентов и внедрения продвинутого семантического…

1 мин

02 МАР

Daily · Replicate · Replicate

Nano Banana Pro: обходит лимиты Google с резервной моделью

Генерация изображений с помощью nano-banana-pro теперь стала надежнее. Replicate представил механизм резервирования, который позволяет продолжить работу, даже если основной API Google достигнет своих лимитов. Это…

2 мин

24 ДЕК

Daily · Groq · Groq

Groq делится технологией инференса с Nvidia: команда переходит, GroqCloud продолжает работу

Groq, известный своими специализированными процессорами LPU для высокоскоростного инференса, объявил о неожиданном стратегическом шаге: компания заключила неисключительное лицензионное соглашение с Nvidia. Часть…

1 мин

01 ДЕК

Daily · DeepSeek · DeepSeek

DeepSeek-V3.2: Две модели и временный чемпион по рассуждению

Необычный шаг от DeepSeek: наряду с регулярным обновлением до версии deepseek-v3-2, компания выпустила крайне производительную, но временную модель deepseek-v3-2-speciale. Это создает интересную дилемму для…

2 мин

29 СЕН

Daily · DeepSeek · DeepSeek

DeepSeek-V3.2-Exp: разреженное внимание ускоряет длинный контекст и снижает цены

Когда провайдеры моделей радикально меняют архитектуру, это обычно означает одно из двух: либо решаются фундаментальные проблемы производительности, либо открываются новые возможности для разработчиков. В случае с…

2 мин

22 СЕН

Daily · DeepSeek · DeepSeek

DeepSeek-V3.1-Terminus: фокус на консистентность и агентов

Гибридные модели, совмещающие разные языки, часто привносят неожиданные артефакты в выводе. DeepSeek выпустил обновление V3.1-Terminus для своих моделей deepseek-chat и deepseek-reasoner, заявленная цель которого — не…

2 мин

21 АВГ

Daily · DeepSeek · DeepSeek

DeepSeek-V3.1: Гибридная архитектура объединяет мысль и скорость

DeepSeek выпустил новую модель deepseek-v3-1, которая стирает границу между режимами «думающий» (thinking) и «недумающий» (non-thinking). Теперь эти два подхода объединены в единую гибридную архитектуру, что должно…

2 мин

28 МАЯ

Daily · DeepSeek · DeepSeek

DeepSeek-R1-0528: Новые возможности рассуждения и функции

На рынке LLM, где каждый новый релиз обещает "лучшую логику", DeepSeek делает конкретный шаг с обновлением своей модели deepseek-reasoner до версии deepseek-r1-0528. Этот релиз не просто заявляет об улучшениях, но и…

2 мин

20 ЯНВ

Daily · DeepSeek · DeepSeek

DeepSeek-R1: Новое поколение моделей рассуждений и открытый исходный код

Когда речь заходит о больших языковых моделях, производительность в задачах рассуждений (reasoning), математики и кодирования часто становится главным камнем преткновения. Как добиться паритета с лидерами рынка…

4 мин

Новости AI-стека

Daily · свежие материалы

Deepgram Batch Diarization V2 — в 3,3 раза чаще побеждает старую версию в слепом тесте

Replicate устранил очереди и задержки на кластерах L40S и H200

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

Cog: потоки событий для предсказаний и новые предупреждения

Nova-3 Medical: точность в медицине растет, но что с остальным?

Снижение производительности flux-2-klein-4b

Deepgram Self-Hosted: майский релиз с фильтром ненормативной лексики и улучшенным корейским

Gemini 3.5 Flash в Deepgram: быстрее, эффективнее, но пора мигрировать

DeepSeek-V4-Pro: дисконт, ставший бессрочным

Gemini 3.1 Flash Lite: Deepgram обновляет Voice Agent API — пора мигрировать

Deepgram: когда ненормативная лексика под контролем, а Азия говорит на родных языках

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Flux Multilingual: единая модель для глобальных голосовых агентов — без компромиссов в скорости и точности

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

DeepSeek: V4-модели с контекстом 1M токенов и деприкация старых API

DeepSeek-V4: Контекст в 1M токенов и гибридная архитектура внимания

Agent skills для Replicate: учим ассистентов работать с моделями как про

Groq расширяет выбор моделей: два новых LLM для Enterprise и голоса Orpheus

**Разработчики предлагают несколько советов для получения наилучшего результата:**

Agent API Perplexity: новые модели и прощание со старыми Gemini

Orpheus TTS на GroqCloud: арабский акцент и голосовые команды для реального времени

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Nano Banana Pro: обходит лимиты Google с резервной моделью

Groq делится технологией инференса с Nvidia: команда переходит, GroqCloud продолжает работу

DeepSeek-V3.2: Две модели и временный чемпион по рассуждению

DeepSeek-V3.2-Exp: разреженное внимание ускоряет длинный контекст и снижает цены

DeepSeek-V3.1-Terminus: фокус на консистентность и агентов

DeepSeek-V3.1: Гибридная архитектура объединяет мысль и скорость

DeepSeek-R1-0528: Новые возможности рассуждения и функции

DeepSeek-R1: Новое поколение моделей рассуждений и открытый исходный код

Замечания по сайту

Разработчики предлагают несколько советов для получения наилучшего результата: