Вступление
Gemini 3.6 Flash — это флагманская модель семейства Gemini от Google DeepMind, относящаяся к линейке Flash, которая позиционируется как оптимальный баланс между интеллектом, скоростью и экономической эффективностью. Анонсированная 21 июля 2026 года, она пришла на смену Gemini 3.5 Flash, вышедшей в мае того же года, и стала основной «рабочей лошадкой» (workhorse model) Google для масштабных агентных и мультимодальных задач.
Ключевая «фишка» модели — беспрецедентная эффективность: Gemini 3.6 Flash потребляет на 17% меньше выходных токенов, чем её предшественница, при этом стоимость снижена, а качество выполнения задач выросло. Модель создана на основе отзывов тысяч разработчиков и предприятий, использовавших Gemini 3.5 Flash, и нацелена на решение реальных инженерных проблем: написание продакшн-кода, анализ финансовых данных, миграцию кодовых баз и многошаговые агентные рабочие процессы. Gemini 3.6 Flash — это шаг Google к созданию ИИ-агентов, которые не просто отвечают на вопросы, а выполняют сложные задачи автономно, с минимальным вмешательством человека.
Технические характеристики
Контекстное окно и лимиты токенов
Gemini 3.6 Flash поддерживает контекстное окно размером 1 миллион токенов (1,048,576 входных токенов). Максимальное количество выходных токенов составляет 64 000 (65 536). Это позволяет модели обрабатывать объёмные документы, многотомные кодовые базы и длительные многошаговые диалоги без потери контекста.
Мультимодальность
Модель является истинно мультимодальной и поддерживает ввод текста, изображений, аудио и видео. На данный момент вывод осуществляется в текстовом формате, но это покрывает подавляющее большинство производственных сценариев — от генерации кода до анализа финансовой отчётности.
Функция мышления (Thinking)
Модель поддерживает встроенную функцию мышления (thinking) с настраиваемым уровнем глубины рассуждений. Это позволяет разработчикам выбирать баланс между качеством ответа, задержкой и стоимостью в зависимости от сложности задачи.
Встроенные инструменты
Gemini 3.6 Flash поставляется с полным набором встроенных инструментов платформы Gemini, включая функцию «Использование компьютера» (Computer Use) в режиме предварительной версии. Это позволяет модели взаимодействовать с графическим интерфейсом пользователя, выполняя действия от имени агента.
Дата обрезания знаний (Knowledge Cutoff)
Важное улучшение — дата обрезания знаний сдвинута с января 2025 года до марта 2026 года, что делает модель актуальной для современных задач.
Идентификатор модели
Для использования в API и на платформах разработки модель имеет идентификатор gemini-3.6-flash.
Дата выхода и версии
Дата официального релиза: 21 июля 2026 года.
В этот день Google анонсировала сразу три новые модели семейства Gemini Flash:
- Gemini 3.6 Flash — Основная универсальная модель для агентных и мультимодальных задач (
gemini-3.6-flash) - Gemini 3.5 Flash-Lite — Самая быстрая и дешёвая модель 3.5 для высоконагруженных сценариев (
gemini-3.5-flash-lite) - Gemini 3.5 Flash Cyber — Специализированная модель для поиска и исправления уязвимостей в коде
Предшественники: Gemini 3.6 Flash построена на базе Gemini 3.5 Flash, выпущенной в мае 2026 года на конференции Google I/O. В свою очередь, Gemini 3.5 Flash стала развитием Gemini 3 Flash, сохранив ключевые архитектурные принципы скорости и эффективности.
Доступность: На момент анонса модели стали доступны в Gemini App (веб-версия и мобильное приложение), Google AI Studio, Gemini API и Android Studio.
Дополнительные сведения
Производительность в бенчмарках
Gemini 3.6 Flash показывает значительный прогресс по сравнению с Gemini 3.5 Flash:
| Бенчмарк | Gemini 3.5 Flash | Gemini 3.6 Flash | Прирост |
|---|---|---|---|
| DeepSWE (программирование) | 37% | 49% | +12 п.п. |
| MLE Bench (ML-исследования) | 49.7% | 63.9% | +14.2 п.п. |
| GDPval-AA (знаниевая работа) | 1349 | 1421 | +72 балла |
| OSWorld-Verified (использование компьютера) | 78.4% | 83% | +4.6 п.п. |
Согласно Artificial Analysis Index, Gemini 3.6 Flash также выполняет задачи в среднем на 12% быстрее. В тестах на мультимодальное понимание модели семейства Flash показывают результаты на уровне лучших флагманских моделей (84.2% на CharXiv Reasoning).
Скорость и эффективность
Gemini 3.5 Flash (предшественница) уже демонстрировала выдающуюся скорость — в 4 раза быстрее других передовых моделей при сопоставимом качестве. Gemini 3.6 Flash сохраняет эту скорость, одновременно сокращая количество токенов и шагов рассуждений.
Ценообразование
Стоимость использования Gemini 3.6 Flash через API:
| Модель | Входные токены | Выходные токены |
|---|---|---|
| Gemini 3.6 Flash | $1.50 / 1M | $7.50 / 1M |
| Gemini 3.5 Flash-Lite | $0.30 / 1M | $2.50 / 1M |
Для сравнения: Gemini 3.5 Flash стоила $9 за 1M выходных токенов, так что 3.6 Flash предлагает лучшее качество по более низкой цене.
Будущее семейства Gemini
Google также подтвердила, что Gemini 3.5 Pro проходит тестирование с партнёрами и станет общедоступной «как только будет готова». Кроме того, команда DeepMind уже начала предварительное обучение Gemini 4 — следующего поколения моделей.
Официальный сайт: https://ai.google.dev/gemini-api



