Обычно новые модели приносят только улучшения, но Google с обновлением Gemini Flash 3.6 и 3.5 Lite не только обновил линейку, но и заставил пересмотреть привычные методы работы с API: устарели ключевые параметры генерации текста.
Google официально выпустил стабильные, готовые к продакшену версии моделей Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. Они ориентированы на высокую эффективность и низкую стоимость при выполнении агентных задач, а также для автоматизации больших объемов.
Gemini 3.6 Flash (ID gemini-3.6-flash) предлагает улучшенную эффективность использования токенов и расширенные возможности для кодирования и агентного планирования. Модель позиционируется как более, чем предыдущая 3.5 Flash, и при этом имеет более низкую цену: $1.50 за 1 млн входных токенов и $7.50 за 1 млн выходных токенов. Модель поддерживает контекстное окно в 1 млн токенов и до 64 тысяч выходных токенов.
Gemini 3.5 Flash-Lite (ID gemini-3.5-flash-lite) — самый быстрый и экономичный вариант в семействе 3.5. Она предназначена для использования в качестве субагента, обеспечивая низкую задержку и высокую экономическую эффективность для автоматизации большого объема задач. Стоимость этой модели ниже: $0.30 за 1 млн входных токенов и $2.50 за 1 млн выходных токенов. Как и 3.6 Flash, она поддерживает контекстное окно в 1 млн токенов и до 64 тысяч выходных токенов.
Одновременно с выпуском моделей Google объявил об устаревании параметров сэмплирования temperature, top_p и top_k. Эти параметры, традиционно используемые для контроля случайности и разнообразия генерируемого текста, больше не будут поддерживаться. Это означает, что разработчикам потребуется пересмотреть логику своих приложений, использующих эти настройки.
Google рекомендует использовать новый Interactions API, который теперь также общедоступен (GA) и предоставляет доступ ко всем новейшим функциям и моделям. Для облегчения перехода Google предлагает инструменты миграции на базе кодирующих агентов (например, Antigravity) с использованием специальных навыков (gemini-interactions-api).
Хотя новые Flash-модели предлагают более выгодные условия для агентных задач, отказ от привычных параметров сэмплирования потребует от разработчиков перенастройки и адаптации существующих промптов и методов генерации. Это может быть как возможностью для оптимизации, так и источником временных сложностей для тех, кто активно использовал эти настройки.