AI News Watcher
Tuesday, Jul 21, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Jul 21, 2026 · 2 min read · Google ← Back to feed

Gemini 3.6 Flash и 3.5 Flash-Lite: Google поменял модели и настройки генерации daily

Новые Flash-модели для агентных задач стали дешевле, но разработчикам придётся пересмотреть старые промпты.

Gemini 3.6 Flash и 3.5 Flash-Lite: Google поменял модели и настройки генерации
Редакция · Daily briefing

Обычно новые модели приносят только улучшения, но Google с обновлением Gemini Flash 3.6 и 3.5 Lite не только обновил линейку, но и заставил пересмотреть привычные методы работы с API: устарели ключевые параметры генерации текста.

Google официально выпустил стабильные, готовые к продакшену версии моделей Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. Они ориентированы на высокую эффективность и низкую стоимость при выполнении агентных задач, а также для автоматизации больших объемов.

Gemini 3.6 Flash (ID gemini-3.6-flash) предлагает улучшенную эффективность использования токенов и расширенные возможности для кодирования и агентного планирования. Модель позиционируется как более, чем предыдущая 3.5 Flash, и при этом имеет более низкую цену: $1.50 за 1 млн входных токенов и $7.50 за 1 млн выходных токенов. Модель поддерживает контекстное окно в 1 млн токенов и до 64 тысяч выходных токенов.

Gemini 3.5 Flash-Lite (ID gemini-3.5-flash-lite) — самый быстрый и экономичный вариант в семействе 3.5. Она предназначена для использования в качестве субагента, обеспечивая низкую задержку и высокую экономическую эффективность для автоматизации большого объема задач. Стоимость этой модели ниже: $0.30 за 1 млн входных токенов и $2.50 за 1 млн выходных токенов. Как и 3.6 Flash, она поддерживает контекстное окно в 1 млн токенов и до 64 тысяч выходных токенов.

Одновременно с выпуском моделей Google объявил об устаревании параметров сэмплирования temperature, top_p и top_k. Эти параметры, традиционно используемые для контроля случайности и разнообразия генерируемого текста, больше не будут поддерживаться. Это означает, что разработчикам потребуется пересмотреть логику своих приложений, использующих эти настройки.

Google рекомендует использовать новый Interactions API, который теперь также общедоступен (GA) и предоставляет доступ ко всем новейшим функциям и моделям. Для облегчения перехода Google предлагает инструменты миграции на базе кодирующих агентов (например, Antigravity) с использованием специальных навыков (gemini-interactions-api).

Хотя новые Flash-модели предлагают более выгодные условия для агентных задач, отказ от привычных параметров сэмплирования потребует от разработчиков перенастройки и адаптации существующих промптов и методов генерации. Это может быть как возможностью для оптимизации, так и источником временных сложностей для тех, кто активно использовал эти настройки.

Дополнительные источники

  1. https://ai.google.dev/gemini-api/docs/latest-model
  2. https://ai.google.dev/gemini-api/docs/deprecations
  3. https://ai.google.dev/gemini-api/docs/billing
  4. https://ai.google.dev/gemini-api/docs/agents
  5. https://deepmind.google/blog/introducing-gemini-3-5-cyber-flash/
  6. https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash
  7. getodin.ai

Источники

  1. https://ai.google.dev/gemini-api/docs/changelog#07-21-2026 docs
  2. https://deepmind.google/blog/introducing-gemini-36-flash-35-flash-lite-and-35-flash-cyber/ blog
→ Опубликовано в Telegram: @agentic_ai_news/728