AI/News — anthropic ecosystem newsroom

Daily · свежие материалы

хронологический список

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, активно участвовал в конференции Google I/O. Он продемонстрировал возможности интеграции multimodal-file-search и vision-agents для создания…

2 мин

21 МАЯ

Daily · Microsoft AI · Microsoft AI

Microsoft Foundry: ИИ просит о помощи, агенты помнят и новые модели

Экосистема Microsoft AI расширяется новыми возможностями для управляемых агентов: от архитектур, где ИИ умеет запрашивать человеческое участие, до внедрения долговременной памяти и целого набора новых моделей. Эти…

8 мин

21 МАЯ

Daily · Google · Google

Google DeepMind Accelerator: AI против климатических рисков в АТР

Google DeepMind запускает Google DeepMind Accelerator — трехмесячную программу, сфокусированную на инициативе «AI for the Planet». Этот акселератор ориентирован на поддержку инноваторов в Азиатско-Тихоокеанском регионе…

2 мин

20 МАЯ

Daily · Microsoft AI · Microsoft AI

GitHub Copilot: стабильные метрики, новые модели и умный поиск

Разработка с помощью AI становится всё более детализированной, и за кадром постоянно меняется инфраструктура: от того, где хранятся отчеты, до того, какие модели скрываются за привычным чатом. GitHub Copilot продолжает…

4 мин

20 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs: намек на Google I/O и «прогретые TPU»

ElevenLabs, известная своими технологиями синтеза речи, через своего руководителя по работе с разработчиками Торстена Шеффа сделала загадочный анонс в X, подогревая интерес к предстоящему мероприятию Google I/O…

1 мин

18 МАЯ

Daily · Stability AI · Stability AI

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Stability AI выпустила Stable Audio 3 — новую открытую модель для генерации и редактирования аудио. Эта модель представляет собой семейство быстрых латентных диффузионных моделей, способных создавать аудио переменной…

3 мин

18 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Взгляд изнутри ElevenLabs

Сегодняшний день не принес крупных анонсов или обновлений от ElevenLabs. Вместо этого, фокус сместился на внутренние события и личные наблюдения сотрудников, что дает редкую возможность заглянуть за кулисы повседневной…

1 мин

17 МАЯ

Daily · Stability AI · Stability AI

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

Stability AI представила SAME (Semantically-Aligned Music Autoencoder) — открытый автоэнкодер, который призван изменить подходы к работе с музыкальными и общими аудиоданными. Его основная задача — эффективное сжатие…

3 мин

13 МАЯ

Daily · ElevenLabs · ElevenLabs

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

ElevenLabs выпустила набор обновлений, затрагивающих как инструментарий для работы с агентами, так и базовые API. Среди наиболее заметных изменений — появление детализированных SIP-логов для отладки, новый API для…

2 мин

07 МАЯ

Daily · Microsoft AI · Microsoft AI

Phi-Ground-Any: Модель для точного взаимодействия с UI

Microsoft выпустила новый открытый весовой вариант модели из семейства Phi-Ground — phi-ground-any. Это мультимодальная модель, ориентированная на взаимодействие с пользовательскими интерфейсами на основе визуального…

4 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

06 МАЯ

Daily · Google · Google

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Google анонсировал ломающее изменение в Gemini Interactions API: схема outputs→steps и response_format меняются, новая дефолтная 26 мая, старую удаляют 8 июня. И это не первый раз — API ломали ещё в декабре. Рядом …

3 мин

04 МАЯ

Daily · ElevenLabs · ElevenLabs

ElevenLabs: прибавление в семействе LLM и доработка ключевых инструментов

ElevenLabs продолжает обновлять свою платформу, интегрируя новые LLM-модели и улучшая инструменты для работы с агентами и креативным контентом. На фоне стремительного развития LLM-экосистемы, компания пополняет свой…

2 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

27 АПР

Daily · Microsoft AI · Microsoft AI

Microsoft 365 Copilot: глубина анализа и генерация изображений прямо в офисных приложениях

Microsoft интегрирует две новые модели в microsoft-365-copilot: GPT-5.5 Thinking для углубленного анализа и многоэтапной работы, а также ChatGPT Images 2.0 для визуального создания контента. Эти обновления позволяют…

3 мин

27 АПР

Daily · ElevenLabs · ElevenLabs

ElevenLabs: Больше контроля над агентами и улучшенная транскрипция в реальном времени

В последнее время фокус многих вендоров AI-инфраструктуры смещается в сторону более детального управления поведением агентов и прозрачности их работы. ElevenLabs не исключение: набор изменений за прошедший день…

4 мин

22 АПР

Daily · Google · Google

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Модель внедрения gemini-embedding-2 достигла статуса общей доступности (GA), что делает её готовой для продакшен-нагрузок и интеграции в полноценные приложения. Это событие совпало с презентацией Google DeepMind новой…

3 мин

21 АПР

Daily · Replicate · Replicate

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

2 мин

15 АПР

Daily · Replicate · Replicate

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

4 мин

15 АПР

Daily · Google · Google

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Google выкатил в preview Gemini 3.1 Flash TTS. Раньше синтез речи — «выбери голос из списка». Теперь голосом управляют как режиссёр актёром, указаниями прямо в тексте через аудиометки, а найденную постановку можно…

2 мин

14 АПР

Daily · Google · Google

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Google расширяет свою AI-инфраструктуру, предлагая как новые возможности для сторонних моделей, так и улучшения для собственных. На этой неделе стал доступен Claude Opus 4.7 в Vertex AI Model Garden, предоставляя…

2 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

02 АПР

Daily · Google · Google

Gemma 4 отдают даром — и в тот же день ставят таймер на Gemini 2.5

Google выпустил Gemma 4 — открытые модели под Apache 2.0: 3-е и 6-е места среди всех open-моделей мира, обходят те, что в 20 раз крупнее, запускаются хоть на телефоне, хоть на одной видеокарте. А в том же окне тихо…

4 мин

25 МАР

Daily · Google · Google

Lyria 3 Pro: песня целиком — но имитировать артиста модель отказывается

Google выпустил Lyria 3 Pro — модель генерации музыки: уже не 30-секундная петля, а трек до трёх минут с заданной структурой (интро/куплет/припев/бридж по запросу). Но Google намеренно сделал так, что имитировать…

3 мин

25 МАР

Daily · ElevenLabs · ElevenLabs

ElevenLabs делит места в рабочих пространствах на «полные» и «базовые»

ElevenLabs изменила подход к управлению доступом внутри рабочих пространств, введя два различных типа мест: Full Seats и Basic Seats. Это изменение направлено на более гибкое распределение ресурсов для команд…

1 мин

04 МАР

Daily · Perplexity · Perplexity

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Perplexity выпустила в общий доступ (GA) свои Agent API и Embeddings API. Это означает, что разработчики теперь могут использовать инструменты для создания автономных агентов и внедрения продвинутого семантического…

1 мин

02 МАР

Daily · Replicate · Replicate

Nano Banana Pro: обходит лимиты Google с резервной моделью

Генерация изображений с помощью nano-banana-pro теперь стала надежнее. Replicate представил механизм резервирования, который позволяет продолжить работу, даже если основной API Google достигнет своих лимитов. Это…

2 мин

19 НОЯ

Daily · Stability AI · Stability AI

Stable Audio: Warner Music Group и Stability AI создадут этичный AI для музыки

Warner Music Group и Stability AI объявили о партнёрстве, цель которого — разработка нового поколения инструментов для создания музыки с использованием ответственного подхода к искусственному интеллекту. Этот союз…

2 мин

27 ОКТ

Daily · Stability AI · Stability AI

Foley Control: Звук в видео без переобучения тяжелых моделей

Stability AI представила foley-control, новый метод для генерации реалистичных звуковых эффектов (фоли) на основе видео. Подход позволяет добавлять синхронизированные звуки к видео без необходимости переобучать крупные…

2 мин

Новости AI-стека

Daily · свежие материалы

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Microsoft Foundry: ИИ просит о помощи, агенты помнят и новые модели

Google DeepMind Accelerator: AI против климатических рисков в АТР

GitHub Copilot: стабильные метрики, новые модели и умный поиск

ElevenLabs: намек на Google I/O и «прогретые TPU»

Stable Audio 3: открытая модель для музыки и звуков с инпейнтингом

Взгляд изнутри ElevenLabs

Stability AI: Как новый автоэнкодер SAME ускоряет генерацию аудио в Stable Audio 3

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

Phi-Ground-Any: Модель для точного взаимодействия с UI

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Gemini Interactions API ломается второй раз за полгода — и снова срочно

ElevenLabs: прибавление в семействе LLM и доработка ключевых инструментов

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Microsoft 365 Copilot: глубина анализа и генерация изображений прямо в офисных приложениях

ElevenLabs: Больше контроля над агентами и улучшенная транскрипция в реальном времени

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Agent skills для Replicate: учим ассистентов работать с моделями как про

**Разработчики предлагают несколько советов для получения наилучшего результата:**

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Agent API Perplexity: новые модели и прощание со старыми Gemini

Gemma 4 отдают даром — и в тот же день ставят таймер на Gemini 2.5

Lyria 3 Pro: песня целиком — но имитировать артиста модель отказывается

ElevenLabs делит места в рабочих пространствах на «полные» и «базовые»

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Nano Banana Pro: обходит лимиты Google с резервной моделью

Stable Audio: Warner Music Group и Stability AI создадут этичный AI для музыки

Foley Control: Звук в видео без переобучения тяжелых моделей

Замечания по сайту

Разработчики предлагают несколько советов для получения наилучшего результата: