Обычно выбор модели — компромисс: берёшь дешёвую и теряешь в качестве на сложных местах, берёшь дорогую — переплачиваешь за простые. OpenRouter запустил инструмент Advisor, который разрывает этот компромисс: быстрая модель ведёт запрос сама, а на трудных решениях вызывает сильную модель как tool call — и продолжает с её советом.
Механика — один tool call, сервер делает всё сам. Добавляешь "type": "openrouter:advisor" в массив tools и указываешь модель-советника. Когда исполнитель упирается в сложное решение — архитектурный выбор, неоднозначный edge case — он вызывает advisor с промптом и получает ответ как tool result. Финальный текст пишет исполнитель сам: советник консультирует, а не диктует. Рекурсия заблокирована на уровне depth-заголовка и проверки самоссылок, число консультаций на запрос ограничено.
Экономика — платишь за дорогую модель только в нужные моменты. GPT-4o Mini стоит $0.15/млн токенов, Claude Fable 5 — $10/млн: разрыв 67x. В типичной агентной сессии из 50 tool calls advisor вызывается 2–3 раза. Токены каждой модели биллятся по её собственным тарифам отдельно — оба счёта видны на странице активности.
Расширенные сценарии: несколько именованных советников и память. Для сложных воркфлоу можно добавить несколько advisor-записей с разными именами, моделями и инструкциями:
- security-reviewer — Claude Fable 5 с инструкцией искать уязвимости.
- architect — GPT-5.5 с фокусом на простоту и масштабируемость.
- default-советник — одна запись без имени, если специализация не нужна.
Каждый советник помнит свои предыдущие консультации в рамках сессии: при повторном запросе история реплеится, и follow-up строится на том, что советник уже сказал. Советнику можно дать собственные инструменты — например, openrouter:web_search, и тогда он отработает как суб-агент с собственным tool loop, прежде чем вернуть итоговый совет.
Advisor — это фактически runtime-роутинг внутри одного запроса: модель сама решает, когда ей нужна помощь умнее. Архитектурно это интереснее статического выбора модели или каскада, где порог эскалации задаёт разработчик заранее. Честный пробел: OpenRouter не раскрывает, как именно модель-исполнитель решает вызывать advisor. Это остаётся на усмотрение самой модели — и насколько предсказуемы такие вызовы в продакшне, пока неизвестно.