AI/News — anthropic ecosystem newsroom

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Cerebras · Cerebras

StepFun Step 3.5/3.7 Flash появились на выделенных эндпоинтах Cerebras

Cerebras открыл dedicated endpoints для Step 3.5 Flash и Step 3.7 Flash от StepFun. Enterprise-клиенты получают изолированную инфраструктуру под MoE-модели — и это не просто удобство, а принципиальный сдвиг для…

1 мин

01 ИЮН

Daily · Google · Google

Gemini 2.0 Flash отключён — что ставить вместо него

1 июня 2026 г. Google отключила четыре модели Gemini 2.0 Flash в Gemini API — любой вызов к этим эндпоинтам теперь падает, и нужна явная миграция. Примечательно здесь не само отключение, а то, куда ведут замены: не в…

1 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · Google · Google

Gemini Image Models: видео в картинку, но не для всех

Google представила обновленную линейку моделей Nano Banana для генерации и редактирования изображений, а также расширила функции понимания видеоконтента, открывая мультимодальные возможности для разработчиков.

7 мин

27 МАЯ

Daily · Cerebras · Cerebras

Cerebras: две модели уходят в запас, время миграции

Cerebras прекращает поддержку моделей llama3.1-8b и qwen-3-235b-a22b-instruct-2507 с 27 мая 2026 года, призывая пользователей к переходу на рекомендованные альтернативы.

9 мин

26 МАЯ

Daily · Google · Google

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google консолидирует все ИИ-сервисы Vertex AI в унифицированной Gemini Enterprise Agent Platform, фокусируясь на комплексной разработке и управлении корпоративными агентами.

7 мин

26 МАЯ

Daily · Cerebras · Cerebras

Cerebras: суверенитет в ИИ — как его видит производитель вафельных чипов

Cerebras запускает глобальную инициативу “Cerebras for Nations” для поддержки стран в развитии собственного ИИ, обеспечивая контроль над инфраструктурой, моделями и данными.

11 мин

21 МАЯ

Daily · Google · Google

Google DeepMind Accelerator: AI против климатических рисков в АТР

Google DeepMind запускает Google DeepMind Accelerator — трехмесячную программу, сфокусированную на инициативе «AI for the Planet». Этот акселератор ориентирован на поддержку инноваторов в Азиатско-Тихоокеанском регионе…

2 мин

18 МАЯ

Daily · Stability AI · Stability AI

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI выпустила Stable Audio 3 — новую открытую модель для генерации и редактирования аудио. Эта модель представляет собой семейство быстрых латентных диффузионных моделей, способных создавать аудио переменной…

3 мин

17 МАЯ

Daily · Stability AI · Stability AI

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Stability AI представила SAME (Semantically-Aligned Music Autoencoder) — открытый автоэнкодер, который призван изменить подходы к работе с музыкальными и общими аудиоданными. Его основная задача — эффективное сжатие…

3 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

06 МАЯ

Daily · AssemblyAI · AssemblyAI

AssemblyAI: когда JSON самоисправляется, а голоса чётко делятся по словам

Работа с моделями в продакшене всегда подразумевает компромиссы: LLM могут «глючить» с JSON-форматом, а аудиомодели — неточно разделять голоса в потоке. На этой неделе AssemblyAI показала два обновления, которые решают…

2 мин

06 МАЯ

Daily · Google · Google

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Google анонсировал ломающее изменение в Gemini Interactions API: схема outputs→steps и response_format меняются, новая дефолтная 26 мая, старую удаляют 8 июня. И это не первый раз — API ломали ещё в декабре. Рядом …

3 мин

01 МАЯ

Daily · Cerebras · Cerebras

Cerebras: инцидент с Qwen-моделью и 5-кратный прирост для coding-агентов Cognition

Cerebras сообщила об устранении инцидента с одной из своих моделей и сделала общедоступной важную функциональность для управления API-ключами. Параллельно компания представила результаты работы с Cognition, где их…

3 мин

29 АПР

Daily · AssemblyAI · AssemblyAI

Voice Agent API: «позвонилка» с LLM-мозгом в один WebSocket

AssemblyAI Voice Agent API — это единый конвейер для создания голосовых агентов, который умеет понимать речь, рассуждать на базе LLM и генерировать голос. Он упакован в один WebSocket и позволяет обойтись без сложной…

2 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

27 АПР

Daily · Cerebras · Cerebras

Cerebras: выделенные конечные точки теперь поддерживают GLM 5 и Kimi K2.6

Cerebras добавляет новые модели от Z.AI и Moonshot AI на свои выделенные конечные точки. Этот шаг призван предоставить инженерам больше гибкости и выбора для развертывания специфических языковых моделей…

1 мин

25 АПР

Daily · AssemblyAI · AssemblyAI

PII Redaction: два транскрипта в одном запросе — удобно для UI, но не без подвоха

Соблюдение конфиденциальности данных и обеспечение полноты информации часто идут рука об руку с компромиссами. Например, когда PII Redaction скрывает персональные данные в транскриптах, это хорошо для безопасности, но…

2 мин

22 АПР

Daily · Cerebras · Cerebras

Cerebras: ключ к кэшу промптов ускорит LLM-инференс, но две модели уйдут в отставку

Cerebras обновила свой API, добавив параметр prompt_cache_key, который позволяет управлять кэшированием промптов и сократить задержку до первого токена. Это небольшое, но важное изменение даёт инженерам больше контроля…

2 мин

22 АПР

Daily · Google · Google

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Модель внедрения gemini-embedding-2 достигла статуса общей доступности (GA), что делает её готовой для продакшен-нагрузок и интеграции в полноценные приложения. Это событие совпало с презентацией Google DeepMind новой…

3 мин

21 АПР

Daily · Replicate · Replicate

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

2 мин

19 АПР

Daily · AssemblyAI · AssemblyAI

Claude Opus 4.7 на LLM Gateway AssemblyAI: доступ к интеллекту Anthropic

AssemblyAI, известный своей платформой для работы с аудио, добавил поддержку новейшей модели Claude Opus 4.7 в свой LLM Gateway. Это значит, что инженеры теперь могут использовать одну из самых интеллектуальных моделей…

1 мин

15 АПР

Daily · Replicate · Replicate

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

4 мин

Новости AI-стека

Daily · свежие материалы

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Stability AI нашла способ экономить память при длинных текстах и видео

Replicate устранил очереди и задержки на кластерах L40S и H200

Cerebras Inference лёг из-за сбоя биллинга AWS

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

StepFun Step 3.5/3.7 Flash появились на выделенных эндпоинтах Cerebras

Gemini 2.0 Flash отключён — что ставить вместо него

Cog: потоки событий для предсказаний и новые предупреждения

Снижение производительности flux-2-klein-4b

Gemini Image Models: видео в картинку, но не для всех

Cerebras: две модели уходят в запас, время миграции

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Cerebras: суверенитет в ИИ — как его видит производитель вафельных чипов

Google DeepMind Accelerator: AI против климатических рисков в АТР

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

AssemblyAI: когда JSON самоисправляется, а голоса чётко делятся по словам

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Cerebras: инцидент с Qwen-моделью и 5-кратный прирост для coding-агентов Cognition

Voice Agent API: «позвонилка» с LLM-мозгом в один WebSocket

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Cerebras: выделенные конечные точки теперь поддерживают GLM 5 и Kimi K2.6

PII Redaction: два транскрипта в одном запросе — удобно для UI, но не без подвоха

Cerebras: ключ к кэшу промптов ускорит LLM-инференс, но две модели уйдут в отставку

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Agent skills для Replicate: учим ассистентов работать с моделями как про

Claude Opus 4.7 на LLM Gateway AssemblyAI: доступ к интеллекту Anthropic

**Разработчики предлагают несколько советов для получения наилучшего результата:**

Замечания по сайту

Разработчики предлагают несколько советов для получения наилучшего результата: