Разработчики привыкли платить за каждый токен, особенно когда речь идёт о больших контекстах. OpenRouter теперь бесплатно предоставляет доступ к Ling 3.0 Flash Fin — модели, способной обрабатывать до 262 тысяч токенов.
Модель Ling 3.0 Flash Fin теперь доступна на OpenRouter без оплаты. Она предлагает обширное контекстное окно в 262 тысячи токенов, что позволяет эффективно обрабатывать длинные документы и сложные диалоги.
Ling 3.0 Flash Fin, разработанная inclusionAI, имеет 124 миллиарда общих параметров, но активирует лишь 5.1 миллиарда на токен. Такая гибридная архитектура (KDA и MLA с разреженным MoE) позволяет ей демонстрировать производительность, сравнимую или превосходящую модели с 1 триллионом параметров.
Модель оптимизирована для реальных рабочих процессов и создания агентных систем. Она прошла обучение в более чем 10 тысячах интерактивных сред, включая задачи по кодированию, общим вычислениям и глубоким исследованиям.
Доступность такой **** и эффективной модели с бесплатным доступом и огромным контекстом может ускорить разработку сложных AI-агентов. Однако inclusionAI пока не раскрыла подробности о лицензировании для коммерческого использования Ling 3.0 Flash Fin вне платформы OpenRouter.