AI/News — anthropic ecosystem newsroom

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Google · Google

Gemini 2.0 Flash отключён — что ставить вместо него

1 июня 2026 г. Google отключила четыре модели Gemini 2.0 Flash в Gemini API — любой вызов к этим эндпоинтам теперь падает, и нужна явная миграция. Примечательно здесь не само отключение, а то, куда ведут замены: не в…

1 мин

01 ИЮН

Daily · MiniMax · MiniMax

MiniMax-M3: 1M-контекст через Anthropic SDK за $0.30/M токенов

MiniMax выпустил M3 — агентскую мультимодальную модель с окном 1M токенов, которая подключается как drop-in замена через Anthropic SDK, а в первые 7 дней стоит вдвое дешевле прайса.

1 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · Google · Google

Gemini Image Models: видео в картинку, но не для всех

Google представила обновленную линейку моделей Nano Banana для генерации и редактирования изображений, а также расширила функции понимания видеоконтента, открывая мультимодальные возможности для разработчиков.

7 мин

26 МАЯ

Daily · Google · Google

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google консолидирует все ИИ-сервисы Vertex AI в унифицированной Gemini Enterprise Agent Platform, фокусируясь на комплексной разработке и управлении корпоративными агентами.

7 мин

21 МАЯ

Daily · Google · Google

Google DeepMind Accelerator: AI против климатических рисков в АТР

Google DeepMind запускает Google DeepMind Accelerator — трехмесячную программу, сфокусированную на инициативе «AI for the Planet». Этот акселератор ориентирован на поддержку инноваторов в Азиатско-Тихоокеанском регионе…

2 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

06 МАЯ

Daily · Google · Google

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Google анонсировал ломающее изменение в Gemini Interactions API: схема outputs→steps и response_format меняются, новая дефолтная 26 мая, старую удаляют 8 июня. И это не первый раз — API ломали ещё в декабре. Рядом …

3 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

23 АПР

Daily · Kuaishou · Kuaishou

Kling AI: Первое нативное 4K видео от ИИ — что это значит для продакшена?

Модель Kling AI от Kuaishou теперь предлагает нативный вывод видео в разрешении 4K. Это позиционирует её как первую в мире модель искусственного интеллекта, способную генерировать видео в таком высоком разрешении, что…

1 мин

22 АПР

Daily · Google · Google

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Модель внедрения gemini-embedding-2 достигла статуса общей доступности (GA), что делает её готовой для продакшен-нагрузок и интеграции в полноценные приложения. Это событие совпало с презентацией Google DeepMind новой…

3 мин

21 АПР

Daily · Replicate · Replicate

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

2 мин

15 АПР

Daily · Replicate · Replicate

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

4 мин

15 АПР

Daily · Google · Google

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Google выкатил в preview Gemini 3.1 Flash TTS. Раньше синтез речи — «выбери голос из списка». Теперь голосом управляют как режиссёр актёром, указаниями прямо в тексте через аудиометки, а найденную постановку можно…

2 мин

14 АПР

Daily · Google · Google

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Google расширяет свою AI-инфраструктуру, предлагая как новые возможности для сторонних моделей, так и улучшения для собственных. На этой неделе стал доступен Claude Opus 4.7 в Vertex AI Model Garden, предоставляя…

2 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

09 АПР

Daily · MiniMax · MiniMax

MiniMax-M2.7: модель, которая учит себя программировать

MiniMax представила новую модель MiniMax-M2.7 на Hugging Face, и она примечательна заявленной способностью к самоэволюции. Это означает, что модель не просто выполняет задачи, но активно участвует в собственном…

3 мин

02 АПР

Daily · Google · Google

Gemma 4 отдают даром — и в тот же день ставят таймер на Gemini 2.5

Google выпустил Gemma 4 — открытые модели под Apache 2.0: 3-е и 6-е места среди всех open-моделей мира, обходят те, что в 20 раз крупнее, запускаются хоть на телефоне, хоть на одной видеокарте. А в том же окне тихо…

4 мин

01 АПР

Daily · MiniMax · MiniMax

MiniMax Music-2.6: Музыкальный ИИ теперь пишет и тексты, и инструментал

MiniMax представила новую версию своей модели для генерации музыки Music-2.6. Теперь ИИ может не только создавать музыкальные композиции по текстовому описанию, но и автоматически генерировать тексты песен, а также…

2 мин

25 МАР

Daily · Google · Google

Lyria 3 Pro: песня целиком — но имитировать артиста модель отказывается

Google выпустил Lyria 3 Pro — модель генерации музыки: уже не 30-секундная петля, а трек до трёх минут с заданной структурой (интро/куплет/припев/бридж по запросу). Но Google намеренно сделал так, что имитировать…

3 мин

18 МАР

Daily · MiniMax · MiniMax

MiniMax M2.7: первые отголоски самоэволюции

MiniMax выпустила серию моделей M2.7, заявляя о старте рекурсивного самосовершенствования своих AI-систем. Теперь модели участвуют в собственной эволюции, самостоятельно улучшая свой инструментарий и процессы обучения…

4 мин

16 МАР

Daily · Kuaishou · Kuaishou

Kling AI: совместная работа — теперь с настольным приложением

Kuaishou добавляет в свой инструмент для создания контента Kling AI функции для командной работы. Теперь инженеры и креативщики смогут быстрее обмениваться активами и эффективнее управлять проектами благодаря новым…

1 мин

04 МАР

Daily · Perplexity · Perplexity

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Perplexity выпустила в общий доступ (GA) свои Agent API и Embeddings API. Это означает, что разработчики теперь могут использовать инструменты для создания автономных агентов и внедрения продвинутого семантического…

1 мин

04 МАР

Daily · Kuaishou · Kuaishou

Kling VIDEO 3.0: Новый контроль движения для захвата

Kuaishou представила новую итерацию своего инструмента для создания видео, Kling VIDEO 3.0. Обновление фокусируется на улучшении фундаментальных механик, которые позволяют создавать более детализированные и…

1 мин

02 МАР

Daily · Replicate · Replicate

Nano Banana Pro: обходит лимиты Google с резервной моделью

Генерация изображений с помощью nano-banana-pro теперь стала надежнее. Replicate представил механизм резервирования, который позволяет продолжить работу, даже если основной API Google достигнет своих лимитов. Это…

2 мин

Новости AI-стека

Daily · свежие материалы

DiffusionGemma 26B: 1000 токенов в секунду на H100 без авторегрессии

Gemma 4 12B работает без энкодеров — и умещается на обычном ноутбуке

Replicate устранил очереди и задержки на кластерах L40S и H200

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

Gemini 2.0 Flash отключён — что ставить вместо него

MiniMax-M3: 1M-контекст через Anthropic SDK за $0.30/M токенов

Cog: потоки событий для предсказаний и новые предупреждения

Снижение производительности flux-2-klein-4b

Gemini Image Models: видео в картинку, но не для всех

Vertex AI Extensions уходят: Google переводит фокус на Agent Platform

Google DeepMind Accelerator: AI против климатических рисков в АТР

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Kling AI: Первое нативное 4K видео от ИИ — что это значит для продакшена?

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Agent skills для Replicate: учим ассистентов работать с моделями как про

**Разработчики предлагают несколько советов для получения наилучшего результата:**

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Agent API Perplexity: новые модели и прощание со старыми Gemini

MiniMax-M2.7: модель, которая учит себя программировать

Gemma 4 отдают даром — и в тот же день ставят таймер на Gemini 2.5

MiniMax Music-2.6: Музыкальный ИИ теперь пишет и тексты, и инструментал

Lyria 3 Pro: песня целиком — но имитировать артиста модель отказывается

MiniMax M2.7: первые отголоски самоэволюции

Kling AI: совместная работа — теперь с настольным приложением

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Kling VIDEO 3.0: Новый контроль движения для захвата

Nano Banana Pro: обходит лимиты Google с резервной моделью

Замечания по сайту

Разработчики предлагают несколько советов для получения наилучшего результата: