21 июля Google выпустила сразу три модели: Gemini 3.6 Flash, облегчённую 3.5 Flash-Lite и специальную 3.5 Flash Cyber для задач кибербезопасности. У больших компаний календарь выпусков устроен как вокзальное табло: если смотреть достаточно долго, обязательно что-нибудь прибудет.
В анонсе обещают улучшенный код, знания и работу с инструментами. Всё как положено. Но главное изменение обнаружилось там, куда торжественная музыка обычно не дотягивается: новая Flash тратит меньше токенов и заметно быстрее заканчивает длинные задачи.
Общий показатель интеллекта в независимом тесте при этом не вырос. Получилась редкая история об обновлении, которое не стало умнее, зато научилось не задерживаться. Разберёмся, кому от этого действительно станет легче.
1. Что вошло в новую линейку
Главная модель выпуска, Gemini 3.6 Flash, уже получила статус общедоступной стабильной версии. Её можно использовать в рабочих приложениях через программный интерфейс Gemini API, Google AI Studio, Android Studio и Antigravity. В приложении Gemini она постепенно становится базовой моделью для всех пользователей.
Рядом появилась Gemini 3.5 Flash-Lite. Это дешёвая версия для массовой обработки документов, извлечения данных и других задач, которые запускают тысячами. Она тоже доступна через программный интерфейс и начинает появляться в Поиске Google.
Третья модель называется Gemini 3.5 Flash Cyber. Обычным пользователям её пока не дают. Google собирается подключать правительственные организации и доверенных партнёров, которым модель будет помогать искать уязвимости через проект CodeMender.
Так одна линейка закрывает три понятных желания: получить результат быстрее, заплатить меньше и найти чужую ошибку раньше, чем она станет вашей. В сущности, на этих желаниях держится заметная часть технологического рынка.
2. Умнее модель не стала
В независимом индексе интеллектуальных возможностей Artificial Analysis старая Gemini 3.5 Flash и новая 3.6 Flash получили одинаковые 50 баллов.
Индекс объединяет тесты на рассуждение, знания, математику и программирование. Он не может предсказать каждый реальный запрос, но позволяет сравнить общий уровень моделей по одной методике. Здесь нового уровня нет. Слово «прорыв» можно спокойно вернуть в ящик до следующего анонса.
Отдельные результаты разошлись. В GDPval-AA v2, где оценивают выполнение полезных для бизнеса задач, показатель вырос с 1349 до 1421. В Humanity’s Last Exam, одном из самых сложных тестов, результат пошёл в другую сторону: с 41% до 38%.
На одних задачах 3.6 сильнее, на других показывает прежний уровень или немного уступает. Общего скачка качества независимые цифры пока не подтверждают. Цифры вообще редко разделяют восторг пресс-службы.
3. Зато она научилась заканчивать работу
Главная цифра выпуска связана со временем. В тестах Artificial Analysis новая модель выполняла среднюю задачу за 1,3 минуты. Gemini 3.5 Flash требовалось 2,7 минуты. Разница больше чем двукратная, и здесь обновление наконец перестаёт быть вопросом вкуса.
Это не значит, что любой ответ в чате появится вдвое быстрее. Тест измеряет полную задачу, во время которой модель может рассуждать, писать ответ и пользоваться инструментами. Короткий вопрос даст другую разницу, иногда почти незаметную.
Сама генерация тоже быстрая: около 304 выходных токенов в секунду. Но скорость печати и полное время работы измеряют разные вещи. Модель может бодро выдавать текст после долгого молчания. Может несколько раз открыть один файл, снова сходить в поиск и вернуться с тем выражением лица, которое доступно только программному обеспечению и людям на совещаниях.
У Gemini 3.6 Flash улучшились оба практических показателя. Она быстро генерирует ответ и раньше заканчивает всю цепочку. Для ИИ-агента, который пишет код, изучает документы или проводит многошаговое исследование, второе важнее первого.
Расчётная стоимость одной задачи в том же наборе снизилась с $0,59 до $0,50, примерно на 15%. Миллион входных токенов по-прежнему стоит $1,50, а миллион выходных подешевел с $9 у 3.5 Flash до $7,50 у 3.6. Не та экономия, ради которой меняют жизнь. Но вполне та, ради которой меняют модель в продукте с большим объёмом запросов.
4. Секрет оказался довольно прозаическим
Google объясняет ускорение более экономным рассуждением. В индексе Artificial Analysis новая модель использовала в среднем 23 тысячи выходных токенов на задачу вместо 28 тысяч у 3.5 Flash. Сокращение составило около 17%.
На внутреннем графике Google для DeepSWE разница ещё заметнее: 97 тысяч выходных токенов вместо 276 тысяч. В этом тесте агент исправляет код в настоящих репозиториях. Цифры впечатляют, хотя публикует их сама Google, а компании обычно выбирают для семейного альбома те фотографии, на которых никто не моргнул.
Независимый расчёт стоимости показывает то же направление, поэтому полностью списывать график на удачный свет не приходится. По данным Google, модель также делает меньше повторных вызовов инструментов.
Проще говоря, 3.6 реже продолжает рассуждать после того, как ответ уже найден. Если агент перестал трижды открывать один файл и ходить кругами между поиском и терминалом, пользователь получает результат раньше и платит за меньшее количество токенов. Умение вовремя остановиться оказалось вполне измеримым преимуществом.
5. В таблице Google всё выглядит наряднее
Во внутренних тестах Google новая модель показывает заметный рост. Результат DeepSWE поднялся с 37% до 49%, MLE-Bench с 49,7% до 63,9%, а OSWorld для управления интерфейсами с 78,4% до 83%.
Часть этого роста видна и во внешних данных. Результат GDPval-AA v2 действительно увеличился с 1349 до 1421 в измерениях Artificial Analysis. Но всю таблицу нельзя считать независимым рейтингом: набор тестов и способ запуска для анонса выбрала Google. Было бы странно, если бы она выбрала иначе.
В документации нашлась и менее праздничная деталь. В некоторых сравнениях люди предпочитали визуальную компоновку и стиль интерфейсов предыдущей версии. Google рекомендует давать Gemini 3.6 Flash более точные указания по дизайну.
Для обработки текста и агентной работы переход выглядит относительно понятным. Для создания интерфейсов лучше сначала сравнить две версии на собственных задачах. Иногда новая модель требует более подробного объяснения того, чего от неё хотят. Технология в этом смысле продолжает двигаться пугающе знакомым путём.
6. Что изменится для обычного пользователя
В приложении Gemini переход должен пройти почти незаметно. Новая Flash постепенно становится стандартной моделью, поэтому пользователю не придётся менять настройки или изучать тарифы для разработчиков. Просто длинные запросы и работа с инструментами должны занимать меньше времени.
У разработчиков перемены конкретнее. Идентификатор новой модели: gemini-3.6-flash. Она принимает до 1 048 576 токенов контекста и может выдать до 65 536 токенов в ответе. На вход разрешено передавать текст, изображения, видео, аудио и документы PDF. На выходе модель создаёт только текст.
Gemini 3.6 Flash поддерживает поиск Google, карты, выполнение кода, вызов функций, структурированный вывод и работу с компьютером в режиме предварительного доступа. Она не генерирует изображения или аудио и не поддерживает потоковое взаимодействие в реальном времени. Миллион токенов контекста тоже не гарантирует, что каждый абзац огромного документа будет понят одинаково хорошо. Размер комнаты ещё никогда не гарантировал хорошего разговора.
При переходе есть несколько технических мелочей. Параметры temperature, top_p и top_k для новых моделей больше не влияют на ответ. Заранее заполненное начало ответа тоже не поддерживается. Google рекомендует перевести Gemini 2.5 Flash на 3.6 до запланированного отключения старой модели 16 октября 2026 года. Перед миграцией дату лучше ещё раз проверить в таблице устаревания. Документация редко бывает хорошей литературой, зато иногда спасает выходные.
7. Flash-Lite считает деньги, Cyber ищет уязвимости
Gemini 3.5 Flash-Lite стоит $0,30 за миллион входных и $2,50 за миллион выходных токенов. Google заявляет скорость до 350 выходных токенов в секунду. В независимом индексе модель набрала 36 баллов против 25 у Gemini 3.1 Flash-Lite.
Эта версия предназначена для массовых и понятных операций: классифицировать обращения, извлекать поля из документов, проверять формат или составлять короткие резюме. Для сложного исследования она слабее, но при больших объёмах разница между $2,50 и $7,50 за выход быстро перестаёт быть мелочью. Бухгалтерия умеет возвращать людям чувство реальности лучше любого теста.
Gemini 3.5 Flash Cyber решает другую задачу. Google описывает её как модель для поиска и исправления уязвимостей, однако публичного доступа пока нет. Позднее компания обещает подключать государственные организации и доверенных партнёров.
Для обычного читателя Cyber пока остаётся идеей с хорошим названием, а не инструментом, который можно открыть сегодня. Таких инструментов у технологической отрасли всегда достаточно.
8. Кому стоит переходить на Gemini 3.6 Flash
Для агентных задач обновление выглядит полезным уже сейчас. Если модель работает с большим проектом, вызывает инструменты или обрабатывает длинные документы, сокращение полного времени с 2,7 до 1,3 минуты заметнее небольшого прироста в очередном тесте. Более дешёвый выход и меньшее число токенов делают решение ещё проще.
Обычному пользователю приложения Gemini ничего делать не нужно. Google сама переведёт сервис на новую Flash. Разработчикам стоит прогнать десять-двадцать типичных задач и сравнить качество, полное время, расход токенов и число вызовов инструментов. Привычка проверять обещания на собственных данных ещё никого не сделала любимцем пресс-службы, но иногда экономит деньги.
Подождать можно тем, кто рассчитывал на большой скачок в сложных рассуждениях или использует модель главным образом для создания интерфейсов. Общий независимый индекс остался прежним. Humanity’s Last Exam показал снижение. Для визуального стиля иногда требуется более точная инструкция.
Gemini 3.6 Flash не стала новой ступенью интеллекта. Она стала хорошо оптимизированной рабочей моделью. Примерно тот же класс задач теперь выполняется быстрее и немного дешевле. Для ежедневной работы это полезнее громкого первого места, хотя на обложке выглядит скромнее.
Модель научилась заканчивать работу и уходить вовремя. Для программного обеспечения это обновление. Люди обычно приходят к тому же выводу позже, когда комната уже опустела и отвечать на сообщения некому.
О новых моделях и других новостях из мира ИИ я пишу в своём Telegram-канале.
ссылка на оригинал статьи https://habr.com/ru/articles/1061722/