AI News Watcher
Wednesday, Jun 10, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Jun 10, 2026 · 2 min read · OpenRouter ← Back to feed

OpenRouter Advisor: дешёвая модель советуется с умной только когда застряла daily

Разрыв в цене — 67x; в типичной сессии из 50 вызовов к дорогой модели обращаются 2–3 раза.

OpenRouter Advisor: дешёвая модель советуется с умной только когда застряла
Редакция · Daily briefing

Обычно выбор модели — компромисс: берёшь дешёвую и теряешь в качестве на сложных местах, берёшь дорогую — переплачиваешь за простые. OpenRouter запустил инструмент Advisor, который разрывает этот компромисс: быстрая модель ведёт запрос сама, а на трудных решениях вызывает сильную модель как tool call — и продолжает с её советом.

Механика — один tool call, сервер делает всё сам. Добавляешь "type": "openrouter:advisor" в массив tools и указываешь модель-советника. Когда исполнитель упирается в сложное решение — архитектурный выбор, неоднозначный edge case — он вызывает advisor с промптом и получает ответ как tool result. Финальный текст пишет исполнитель сам: советник консультирует, а не диктует. Рекурсия заблокирована на уровне depth-заголовка и проверки самоссылок, число консультаций на запрос ограничено.

Экономика — платишь за дорогую модель только в нужные моменты. GPT-4o Mini стоит $0.15/млн токенов, Claude Fable 5 — $10/млн: разрыв 67x. В типичной агентной сессии из 50 tool calls advisor вызывается 2–3 раза. Токены каждой модели биллятся по её собственным тарифам отдельно — оба счёта видны на странице активности.

Расширенные сценарии: несколько именованных советников и память. Для сложных воркфлоу можно добавить несколько advisor-записей с разными именами, моделями и инструкциями:

Каждый советник помнит свои предыдущие консультации в рамках сессии: при повторном запросе история реплеится, и follow-up строится на том, что советник уже сказал. Советнику можно дать собственные инструменты — например, openrouter:web_search, и тогда он отработает как суб-агент с собственным tool loop, прежде чем вернуть итоговый совет.

Advisor — это фактически runtime-роутинг внутри одного запроса: модель сама решает, когда ей нужна помощь умнее. Архитектурно это интереснее статического выбора модели или каскада, где порог эскалации задаёт разработчик заранее. Честный пробел: OpenRouter не раскрывает, как именно модель-исполнитель решает вызывать advisor. Это остаётся на усмотрение самой модели — и насколько предсказуемы такие вызовы в продакшне, пока неизвестно.

Дополнительные источники

  1. Advisor Beta
  2. LiteLLM vs OpenRouter (2026): The Honest Engineering Comparison - SlashLLM
  3. Latency and Performance | OpenRouter Docs
  4. inworld.ai
  5. openrouter.ai
  6. ycombinator.com

Источники

  1. https://openrouter.ai/blog/advisor-server-tool/ news
→ Опубликовано в Telegram: @agentic_ai_news/490