Расход токенов — одна из главных статей затрат при использовании ИИ-агентов. Google выпустила модель Gemini 3.6 Flash, которая, по заявлениям, уменьшает потребление выходных токенов на 17% в сравнении с предыдущей версией. Теперь эта модель внедряется в GitHub Copilot.
Gemini 3.6 Flash, новейшая "быстрая" модель Google, предназначена для веб- и мобильной разработки, общего кодирования и длительных агентных задач. Она поддерживает настраиваемый уровень усилий для рассуждений и параллельное использование инструментов в сложных рабочих процессах.
Ранние тесты показали, что Gemini 3.6 Flash превосходит Gemini 3.5 Flash по показателям выполнения задач и эффективности токенов. Согласно индексу Artificial Analysis, модель снижает потребление выходных токенов на 17%, а в некоторых бенчмарках, таких как DeepSWE, экономия достигает 65%. Это также приводит к снижению стоимости за выходной токен.
Модель развертывается постепенно и будет доступна пользователям Copilot Pro, Pro+, Max, Business и Enterprise. Администраторам планов Copilot Enterprise и Business необходимо включить политику Gemini 3.6 Flash Preview в настройках Copilot.
Поддержка Gemini 3.6 Flash появится в:
- Visual Studio Code и Visual Studio
- Copilot CLI и облачном агенте GitHub Copilot
- Приложении GitHub Copilot
- JetBrains, Xcode и Eclipse
Интеграция Gemini 3.6 Flash напрямую решает проблему высокой стоимости и неэффективности генерации кода для ИИ-агентов, которая сдерживала их массовое внедрение. Снижение расхода токенов и улучшенная логика модели могут сделать разработку агентов доступнее, но фактическая экономия будет зависеть от сценариев использования и тарифных планов Copilot.