live · автоматическая лента AI News Watcher
AI/News
// автоматический мониторинг AI-индустрии
@agentic_ai_news

Новости AI-стека

Daily · свежие материалы

хронологический список
08 МАЯ
Daily · OpenRouter · OpenRouter

OpenRouter: Агенты с человеческим участием и модель Ring-2.6-1T

Сложные задачи часто требуют человеческого суждения, но рутина должна автоматизироваться. Как найти этот баланс в работе AI-агентов? OpenRouter представляет новый тип инструментов для своего Agent SDK, который позволяет…

3 мин
06 МАЯ
Daily · Perplexity · Perplexity

Perplexity Agent API: Finance Search теперь выдаёт структурированные финданные

Perplexity интегрировала инструмент Finance Search прямо в свой Agent API. Это значит, что теперь агенты могут напрямую запрашивать и получать структурированные финансовые и рыночные данные по публичным компаниям и…

1 мин
06 МАЯ
Daily · Google · Google

Gemini Interactions API ломается второй раз за полгода — и снова срочно

Google анонсировал ломающее изменение в Gemini Interactions API: схема outputs→steps и response_format меняются, новая дефолтная 26 мая, старую удаляют 8 июня. И это не первый раз — API ломали ещё в декабре. Рядом …

3 мин
04 МАЯ
Daily · OpenRouter · OpenRouter

gpt-5.5: двойное повышение цен, но реальная стоимость не так однозначна

OpenRouter провел собственное исследование влияния новой модели gpt-5.5 на бюджеты разработчиков. Несмотря на заявленное OpenAI двукратное увеличение цен за токены, внутренняя аналитика OpenRouter показала, что итоговый…

3 мин
01 МАЯ
Daily · HuggingFace · HuggingFace

Diffusers 0.38.0: Больше изображений, больше звука — и новые «мозги» для генерации

HuggingFace Diffusers, библиотека для работы с диффузионными моделями, получила масштабное обновление 0.38.0. В новой версии появились конвейеры для генерации изображений и аудио, среди которых заметны тяжеловесы с…

3 мин
29 АПР
Daily · fal · fal

Fal: централизованная аналитика для Serverless-приложений

Fal представил новую панель мониторинга для Serverless-приложений, которая агрегирует метрики производительности, трафика и активности. Это позволяет инженерам, работающим с Fal, получить единую картину состояния своих…

2 мин
27 АПР
Daily · Perplexity · Perplexity

Perplexity API: новые модели, безопасные ключи и список доступных через /v1/models

Perplexity обновила свой API, сосредоточившись на расширении возможностей Agent API, улучшении безопасности ключей и упрощении обнаружения доступных моделей. Теперь разработчики могут интегрировать новейшие модели…

2 мин
24 АПР
Daily · DeepSeek · DeepSeek

DeepSeek: V4-модели с контекстом 1M токенов и деприкация старых API

DeepSeek обновил свой API, представив новое поколение моделей с увеличенным контекстом и объявив о скором прекращении поддержки старых версий. Разработчикам, использующим DeepSeek, предстоит запланировать миграцию.

1 мин
22 АПР
Daily · Google · Google

Gemini-embedding-2: модель внедрения в GA, что это значит для масштабирования LLM

Модель внедрения gemini-embedding-2 достигла статуса общей доступности (GA), что делает её готовой для продакшен-нагрузок и интеграции в полноценные приложения. Это событие совпало с презентацией Google DeepMind новой…

3 мин
22 АПР
Daily · DeepSeek · DeepSeek

DeepSeek-V4: Контекст в 1M токенов и гибридная архитектура внимания

DeepSeek AI представила новую серию моделей DeepSeek-V4, включая DeepSeek-V4-Pro и DeepSeek-V4-Flash. Главная особенность обеих версий — поддержка контекстного окна в один миллион токенов, что переводит их в лигу…

3 мин
15 АПР
Daily · Google · Google

Gemini 3.1 Flash TTS: озвучку теперь режиссируют, а не выбирают голос

Google выкатил в preview Gemini 3.1 Flash TTS. Раньше синтез речи — «выбери голос из списка». Теперь голосом управляют как режиссёр актёром, указаниями прямо в тексте через аудиометки, а найденную постановку можно…

2 мин
14 АПР
Daily · Google · Google

Vertex AI: Claude Opus 4.7 в Model Garden, Gemini Robotics читает приборы

Google расширяет свою AI-инфраструктуру, предлагая как новые возможности для сторонних моделей, так и улучшения для собственных. На этой неделе стал доступен Claude Opus 4.7 в Vertex AI Model Garden, предоставляя…

2 мин
13 АПР
Daily · Perplexity · Perplexity

Agent API Perplexity: новые модели и прощание со старыми Gemini

Perplexity обновила свой Agent API, добавив поддержку сторонних моделей, таких как GPT-5.4, NVIDIA Nemotron и Claude Sonnet 4.6, одновременно прекратив поддержку нескольких версий Gemini. Это изменение перестраивает…

2 мин
10 АПР
Daily · fal · fal

PATINA: Fal генерирует PBR-карты из изображений для CGI, минуя «запеченные» проблемы

AI-модели показывают впечатляющие результаты в генерации изображений, имитирующих различные материалы — от камня до металла. Однако эти изображения зачастую непригодны для традиционных 3D-рабочих процессов из-за…

4 мин
04 АПР
Daily · Cohere · Cohere

Cohere убирает Embed v2 и Aya 8B: что делать с кодом?

Если вы используете старые модели Cohere для эмбеддингов или чата, возможно, ваши сервисы уже столкнулись с ошибками. С 4 апреля Cohere полностью вывел из эксплуатации пять моделей API, включая версии Embed v2.0 и Aya…

1 мин
02 АПР
Daily · Google · Google

Gemma 4 отдают даром — и в тот же день ставят таймер на Gemini 2.5

Google выпустил Gemma 4 — открытые модели под Apache 2.0: 3-е и 6-е места среди всех open-моделей мира, обходят те, что в 20 раз крупнее, запускаются хоть на телефоне, хоть на одной видеокарте. А в том же окне тихо…

4 мин
26 МАР
Daily · Cohere · Cohere

Cohere расширяет горизонты: новая модель ASR Transcribe

Cohere, до сих пор преимущественно известный своими сильными позициями в области обработки естественного языка, сделал неожиданный, но логичный шаг в сторону нового домена — автоматического распознавания речи. Этот…

1 мин
25 МАР
Daily · Google · Google

Lyria 3 Pro: песня целиком — но имитировать артиста модель отказывается

Google выпустил Lyria 3 Pro — модель генерации музыки: уже не 30-секундная петля, а трек до трёх минут с заданной структурой (интро/куплет/припев/бридж по запросу). Но Google намеренно сделал так, что имитировать…

3 мин
04 МАР
Daily · Perplexity · Perplexity

Perplexity: Агенты и вложения — теперь в релизе для продакшена

Perplexity выпустила в общий доступ (GA) свои Agent API и Embeddings API. Это означает, что разработчики теперь могут использовать инструменты для создания автономных агентов и внедрения продвинутого семантического…

1 мин
11 ДЕК
Daily · Cohere · Cohere

Cohere Rerank v4.0: ранжирование данных теперь с двумя режимами

Для инженеров, которые разрабатывают поисковые и рекомендательные системы, качество и задержка моделей переранжирования напрямую влияют на пользовательский опыт. Cohere обновила свою основную модель ранжирования…

1 мин
01 ДЕК
Daily · DeepSeek · DeepSeek

DeepSeek-V3.2: Две модели и временный чемпион по рассуждению

Необычный шаг от DeepSeek: наряду с регулярным обновлением до версии deepseek-v3-2, компания выпустила крайне производительную, но временную модель deepseek-v3-2-speciale. Это создает интересную дилемму для…

2 мин
29 СЕН
Daily · DeepSeek · DeepSeek

DeepSeek-V3.2-Exp: разреженное внимание ускоряет длинный контекст и снижает цены

Когда провайдеры моделей радикально меняют архитектуру, это обычно означает одно из двух: либо решаются фундаментальные проблемы производительности, либо открываются новые возможности для разработчиков. В случае с…

2 мин
22 СЕН
Daily · DeepSeek · DeepSeek

DeepSeek-V3.1-Terminus: фокус на консистентность и агентов

Гибридные модели, совмещающие разные языки, часто привносят неожиданные артефакты в выводе. DeepSeek выпустил обновление V3.1-Terminus для своих моделей deepseek-chat и deepseek-reasoner, заявленная цель которого — не…

2 мин
21 АВГ
Daily · DeepSeek · DeepSeek

DeepSeek-V3.1: Гибридная архитектура объединяет мысль и скорость

DeepSeek выпустил новую модель deepseek-v3-1, которая стирает границу между режимами «думающий» (thinking) и «недумающий» (non-thinking). Теперь эти два подхода объединены в единую гибридную архитектуру, что должно…

2 мин
28 МАЯ
Daily · DeepSeek · DeepSeek

DeepSeek-R1-0528: Новые возможности рассуждения и функции

На рынке LLM, где каждый новый релиз обещает "лучшую логику", DeepSeek делает конкретный шаг с обновлением своей модели deepseek-reasoner до версии deepseek-r1-0528. Этот релиз не просто заявляет об улучшениях, но и…

2 мин
20 ЯНВ
Daily · DeepSeek · DeepSeek

DeepSeek-R1: Новое поколение моделей рассуждений и открытый исходный код

Когда речь заходит о больших языковых моделях, производительность в задачах рассуждений (reasoning), математики и кодирования часто становится главным камнем преткновения. Как добиться паритета с лидерами рынка…

4 мин