AI/News — anthropic ecosystem newsroom

В релиз-кандидате Cog v0.21.0-rc.2 исправлена ошибка, из-за которой cog serve не монтировал managed-веса в контейнер, хотя cog run делал это корректно — модели с весами падали при setup без очевидной причины.

1 мин

01 ИЮН

Daily · Cerebras · Cerebras

StepFun Step 3.5/3.7 Flash появились на выделенных эндпоинтах Cerebras

Cerebras открыл dedicated endpoints для Step 3.5 Flash и Step 3.7 Flash от StepFun. Enterprise-клиенты получают изолированную инфраструктуру под MoE-модели — и это не просто удобство, а принципиальный сдвиг для…

1 мин

29 МАЯ

Daily · ElevenLabs · X · ElevenLabs

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, отметил в своем посте X впечатляющую способность Gemini Omni обрабатывать отражения.

1 мин

29 МАЯ

Daily · Replicate · Replicate

Cog: потоки событий для предсказаний и новые предупреждения

Предварительный релиз Cog v0.21.0-rc.1 вводит Server-Sent Events для realtime-обновлений предсказаний, а также объявляет cog weights экспериментальным.

5 мин

28 МАЯ

Daily · Replicate · Replicate

Снижение производительности flux-2-klein-4b

Наблюдалось снижение производительности модели flux-2-klein-4b, проблема была решена, и время ожидания вернулось к норме.

1 мин

28 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

Торстен Шефф разрабатывает прототип решения для формирования команд на аутригерах прямо во время полета, демонстрируя потенциал быстрой разработки с агентивными ИИ-инструментами.

8 мин

27 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Разработчик Google Торстен Шафф приступил к созданию ИИ-помощника для гребли на каноэ с помощью Gemini 3.5 Flash и Antigravity прямо на борту самолета.

12 мин

27 МАЯ

Daily · Cerebras · Cerebras

Cerebras: две модели уходят в запас, время миграции

Cerebras прекращает поддержку моделей llama3.1-8b и qwen-3-235b-a22b-instruct-2507 с 27 мая 2026 года, призывая пользователей к переходу на рекомендованные альтернативы.

9 мин

26 МАЯ

Daily · Cerebras · Cerebras

Cerebras: суверенитет в ИИ — как его видит производитель вафельных чипов

Cerebras запускает глобальную инициативу “Cerebras for Nations” для поддержки стран в развитии собственного ИИ, обеспечивая контроль над инфраструктурой, моделями и данными.

11 мин

22 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

Торстен Шефф, руководитель отдела по работе с разработчиками ElevenLabs, активно участвовал в конференции Google I/O. Он продемонстрировал возможности интеграции multimodal-file-search и vision-agents для создания…

2 мин

20 МАЯ

Daily · ElevenLabs · X · ElevenLabs

ElevenLabs: намек на Google I/O и «прогретые TPU»

ElevenLabs, известная своими технологиями синтеза речи, через своего руководителя по работе с разработчиками Торстена Шеффа сделала загадочный анонс в X, подогревая интерес к предстоящему мероприятию Google I/O…

1 мин

18 МАЯ

Daily · ElevenLabs · X · ElevenLabs

Взгляд изнутри ElevenLabs

Сегодняшний день не принес крупных анонсов или обновлений от ElevenLabs. Вместо этого, фокус сместился на внутренние события и личные наблюдения сотрудников, что дает редкую возможность заглянуть за кулисы повседневной…

1 мин

13 МАЯ

Daily · ElevenLabs · ElevenLabs

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

ElevenLabs выпустила набор обновлений, затрагивающих как инструментарий для работы с агентами, так и базовые API. Среди наиболее заметных изменений — появление детализированных SIP-логов для отладки, новый API для…

2 мин

06 МАЯ

Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин

04 МАЯ

Daily · ElevenLabs · ElevenLabs

ElevenLabs: прибавление в семействе LLM и доработка ключевых инструментов

ElevenLabs продолжает обновлять свою платформу, интегрируя новые LLM-модели и улучшая инструменты для работы с агентами и креативным контентом. На фоне стремительного развития LLM-экосистемы, компания пополняет свой…

2 мин

01 МАЯ

Daily · Cerebras · Cerebras

Cerebras: инцидент с Qwen-моделью и 5-кратный прирост для coding-агентов Cognition

Cerebras сообщила об устранении инцидента с одной из своих моделей и сделала общедоступной важную функциональность для управления API-ключами. Параллельно компания представила результаты работы с Cognition, где их…

3 мин

27 АПР

Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин

27 АПР

Daily · Cerebras · Cerebras

Cerebras: выделенные конечные точки теперь поддерживают GLM 5 и Kimi K2.6

Cerebras добавляет новые модели от Z.AI и Moonshot AI на свои выделенные конечные точки. Этот шаг призван предоставить инженерам больше гибкости и выбора для развертывания специфических языковых моделей…

1 мин

27 АПР

Daily · ElevenLabs · ElevenLabs

ElevenLabs: Больше контроля над агентами и улучшенная транскрипция в реальном времени

В последнее время фокус многих вендоров AI-инфраструктуры смещается в сторону более детального управления поведением агентов и прозрачности их работы. ElevenLabs не исключение: набор изменений за прошедший день…

4 мин

22 АПР

Daily · Cerebras · Cerebras

Cerebras: ключ к кэшу промптов ускорит LLM-инференс, но две модели уйдут в отставку

Cerebras обновила свой API, добавив параметр prompt_cache_key, который позволяет управлять кэшированием промптов и сократить задержку до первого токена. Это небольшое, но важное изменение даёт инженерам больше контроля…

2 мин

21 АПР

Daily · Replicate · Replicate

Agent skills для Replicate: учим ассистентов работать с моделями как про

Replicate представил Agent skills — набор инструкций в формате Markdown, который позволяет кодирующим ассистентам лучше понимать, как искать, сравнивать и запускать модели ИИ на платформе. Это шаг к тому, чтобы сделать…

2 мин

15 АПР

Daily · Replicate · Replicate

Разработчики предлагают несколько советов для получения наилучшего результата:

Детально описывайте сцену. Вместо «автомобильная погоня» пишите «высокоскоростная ночная погоня по залитым дождём улиц Токио, неоновые отражения на мокром асфальте, фары прорезают туман». Описывайте не только…

4 мин

13 АПР

Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин

25 МАР

Daily · ElevenLabs · ElevenLabs

ElevenLabs делит места в рабочих пространствах на «полные» и «базовые»

ElevenLabs изменила подход к управлению доступом внутри рабочих пространств, введя два различных типа мест: Full Seats и Basic Seats. Это изменение направлено на более гибкое распределение ресурсов для команд…

1 мин

Новости AI-стека

Daily · свежие материалы

ElevenLabs открыл API для разработчиков по всему миру — Grab уже тестирует

Один API-запрос — и агент ElevenLabs сам снял видео

ElevenLabs показала, как создать приложение голосом

Replicate устранил очереди и задержки на кластерах L40S и H200

Cerebras Inference лёг из-за сбоя биллинга AWS

Reachy Mini заговорил без облака: Parakeet + Gemma 4 E4B + Qwen3TTS на борту

Cog v0.21.0-rc.2 закрывает тихий баг: `cog serve` наконец монтирует веса как `cog run`

StepFun Step 3.5/3.7 Flash появились на выделенных эндпоинтах Cerebras

@thorwebdev (Thorsten Schaeff, руководитель отдела по работе с разработчиками): Удивительно, насколько хорошо Gemini Omni справляется с отражениями 🤯

Cog: потоки событий для предсказаний и новые предупреждения

Снижение производительности flux-2-klein-4b

Глава отдела по работе с разработчиками ElevenLabs Торстен Шефф разрабатывает ИИ-помощника для формирования составов команд на лодках-аутригерах, используя Gemini 3.5 Flash.

Gemini 3.5 Flash: помощник для каноэ — за один перелет

Cerebras: две модели уходят в запас, время миграции

Cerebras: суверенитет в ИИ — как его видит производитель вафельных чипов

ElevenLabs на Google I/O: «разговор» с базой знаний и агенты в облаке

ElevenLabs: намек на Google I/O и «прогретые TPU»

Взгляд изнутри ElevenLabs

ElevenLabs: Детализация SIP-звонков, API для RAG-чанков и новые LLM в обновлении 13 мая

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

ElevenLabs: прибавление в семействе LLM и доработка ключевых инструментов

Cerebras: инцидент с Qwen-моделью и 5-кратный прирост для coding-агентов Cognition

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Cerebras: выделенные конечные точки теперь поддерживают GLM 5 и Kimi K2.6

ElevenLabs: Больше контроля над агентами и улучшенная транскрипция в реальном времени

Cerebras: ключ к кэшу промптов ускорит LLM-инференс, но две модели уйдут в отставку

Agent skills для Replicate: учим ассистентов работать с моделями как про

**Разработчики предлагают несколько советов для получения наилучшего результата:**

Agent API Perplexity: новые модели и прощание со старыми Gemini

ElevenLabs делит места в рабочих пространствах на «полные» и «базовые»

Замечания по сайту

Разработчики предлагают несколько советов для получения наилучшего результата: