Важная оговорка: GPT-5.4 Mini вышел в марте 2026, Gemini 3.6 Flash — в июле того же года. Разрыв больше четырех месяцев — это не модели одного поколения. К тому же любимая многими модель Gemini 3.6 Flash уже устарела — 13 августа 2026 года, через три недели после выхода, Google выпустила Gemini 3.7 Flash.

При этом сравнение остается актуальным — обе модели принадлежат к одному классу нейросетей, и логика их развития показательна для понимания, куда движется рынок. Какая нейросеть лучше — GPT-5.4-Mini или Gemini-3.6-Flash — вопрос, который стоит перед любым, кто выбирает бюджетную рабочую модель для высокообъемных задач, а не флагман для разовых сложных сценариев.
Класс моделей: правильное позиционирование
Выбранные нейросети — это бюджетно-скоростной класс, а не флагманы. GPT-5.4 Mini и Gemini 3.6 Flash — рабочие лошадки для высокообъемных нагрузок: субагентные оркестровки, кодинг-пайплайны, рутинная обработка документов. Ни одна не претендует на топ лидербордов общего интеллекта. Сравнивать их стоит по скорости, стоимости, размеру контекста и конкретным рабочим сценариям.
GPT-5.4 Mini: обзор
GPT-5.4 Mini вышел 17 марта 2026 года, через 12 дней после флагмана GPT-5.4 Thinking и Pro. OpenAI ориентирует модель на высокопропускные воркфлоу и оркестровку субагентов — задачи, где важен объем запросов, а не глубина рассуждения на каждом из них. Контекстное окно — 400 тысяч токенов, knowledge cutoff — 31 августа 2025 года.
GPT-5.4 Mini — часть семейства GPT-5.4, куда входят Thinking, Pro, Mini и Nano. Mini занимает среднюю позицию по стоимости и скорости, выше Nano, но заметно доступнее топовых версий.
Цена: $0.75 за миллион входных токенов, $0.075 за миллион кэшированных, $4.50 за миллион выходных. Доступность — через OpenAI API, chatgpt com, Azure и Amazon Bedrock. Интеграция с субагентами нативная, прямо внутри экосистемы OpenAI.
Gemini 3.6 Flash: что нужно знать
Gemini 3.6 Flash от gemini google вышла 21 июля 2026 года — в рамках одного анонса вместе с Gemini 3.5 Flash-Lite и Gemini 3.5 Flash Cyber. Google позиционирует модель как инструмент нового поколения для агентных воркфлоу, кодинга и мультимодальных задач.
Контекстное окно — 1 000 000 токенов, что в 2.5 раза больше, чем у GPT-5.4 Mini, максимум на выходе — 64 тысячи токенов. Knowledge cutoff — на семь месяцев свежее, чем у конкурента.
Цена: $1.50 за миллион входных токенов и $7.50 за миллион выходных — это вводная цена до 31 декабря 2026 года, дальше начнет действовать стандартный тариф. Ключевое заявление Google: модель расходует на 17% меньше выходных токенов, чем предшественница Gemini 3.5 Flash, а на бенчмарке DeepSWE экономия токенов достигает 65%. При этом сама модель стоит дешевле предшественника — $7.50 за выход против $9.00 у версии 3.5.
Скорость генерации — около 280–304 токена в секунду, одна из самых быстрых в своем классе. Доступность — Gemini API, Google AI Studio, Vertex AI, а также интеграция в GitHub Copilot прямо в день запуска. Модель принимает текст, изображения, аудио, видео и PDF, а Computer use — встроенный инструмент управления графическим интерфейсом на стороне клиента — доступен через Gemini API и Gemini Enterprise.
Бенчмарки: конкретные числа
По индексу Artificial Analysis Intelligence Index Gemini 3.6 Flash набирает 50 баллов. Показательный факт: это ровно тот же результат, что у Gemini 3.5 Flash — модель стала быстрее и дешевле, но не умнее предшественника. Данных по GPT-5.4 Mini отдельно от полной версии GPT-5.4 в открытых источниках нет — только по флагманской модели.
На SWE-Bench Pro картина запутаннее из-за разных дат замеров. По данным CodingFleet за июль 2026 года, GPT-5.4 (полная версия) набирает 57.7% против 55.1% у Gemini 3.5 Flash. По данным Tosea, Gemini 3.6 Flash показывает уже 58.7% против тех же 55.1% у предыдущей версии Flash. Прямого сравнения GPT-5.4 Mini против Gemini 3.6 Flash по этому бенчмарку в источниках нет.
На Terminal-Bench у GPT-5.4 (полная версия) результат 75.1%, у Gemini 3.6 Flash на Terminal-Bench 2.1 — 78.0%. Gemini обгоняет даже полную версию GPT-5.4, не говоря о Mini.

По данным LLM-Stats, при сравнении GPT-5.4 mini с Gemini 3 Flash — первой версией, не 3.6 — GPT-5.4 mini выигрывает на пяти бенчмарках: Finance Agent v2, MCP Atlas, MRCR v2 с восемью иглами, OmniDocBench 1.5 и Terminal-Bench 2.0. Gemini 3 Flash выигрывает на четырех: GPQA, Humanity’s Last Exam, MMMU-Pro и Toolathlon. Общий вывод LLM-Stats — у GPT-5.4 mini «незначительное преимущество по бенчмаркам», но важно помнить: это сравнение со старой версией Gemini, а не с 3.6 Flash.
Отдельно стоит выделить тест на длинный контекст — GDM-MRCR v2. На нем Gemini 3.6 Flash набирает 54.0%, примерно вдвое обгоняя обоих предшественников, у которых результат держался в районе 27%. Это прямое следствие миллионного контекстного окна модели.
Цена: честная картина
Базовая разница ощутима: GPT-5.4 Mini стоит $0.75 за миллион входных токенов против $1.50 у Gemini 3.6 Flash, и $4.50 за выход против $7.50. GPT-5.4 Mini дешевле вдвое по входным токенам и на 40% по выходным.
На смешанной нагрузке — миллион на вход плюс миллион на выход — GPT-5.4 Mini обходится в $5.25, Gemini 3.6 Flash — в $9.00. Разница — GPT-5.4 Mini дешевле в 1.7 раза.
Но есть контрпункт. Gemini 3.6 Flash расходует на 17% меньше выходных токенов на ту же самую работу, а на отдельных задачах вроде DeepSWE экономия токенов доходит до 65%. С учетом этого реальная разница в стоимости на конкретную задачу сокращается заметно сильнее, чем показывает базовый прайс. Для задач с коротким выводом разрыв в стоимости минимальный. Для задач с длинными и сложными выходами GPT-5.4 Mini остается дешевле даже с поправкой на эффективность Gemini, но разрыв уже не 1.7 раза, а заметно меньше.
Контекстное окно: самое важное техническое различие
У GPT-5.4 Mini — 400 тысяч токенов контекста. У Gemini 3.6 Flash — 1 миллион, в 2.5 раза больше, без явной надбавки при стандартной работе. Для задач с большими кодовыми базами, длинными PDF-документами, многочасовыми расшифровками переговоров или анализом полных репозиториев это принципиальное преимущество в пользу Gemini.
Скорость и задержка
Gemini 3.6 Flash работает со скоростью около 280–304 токена в секунду. Более легкая версия Gemini 3.5 Flash-Lite еще быстрее — 350 токенов в секунду. По GPT-5.4 Mini точных публичных цифр скорости нет, но линейка Gemini Flash исторически считается одной из самых быстрых в своем классе моделей.

Knowledge cutoff: важно для актуальных задач
У GPT-5.4 Mini знания зафиксированы на 31 августа 2025 года. У Gemini 3.6 Flash — на март 2026 года. Разрыв в семь месяцев ощутим: для задач, где важна актуальность фактов — изменения в законодательстве, свежие версии API, недавние события — Gemini 3.6 Flash объективно информированнее в силу более позднего обучения.
Мультимодальность: принципиальная разница
GPT-5.4 Mini принимает текст и изображения — этим набор входных форматов и ограничивается. Gemini 3.6 Flash работает с текстом, изображениями, аудио, видео и PDF, плюс встроенный Computer use для управления графическим интерфейсом. Для задач с расшифровкой аудио, анализом видеоматериалов или автоматизацией действий в интерфейсе Gemini 3.6 Flash выигрывает по умолчанию — конкурировать здесь GPT-5.4 Mini попросту нечем.
Доступность из России
Оба сервиса напрямую из России недоступны. Chatgpt com и chat gpt в целом заблокированы для прямой регистрации и оплаты российской картой. Gemini google официально ограничивает российскую юрисдикцию точно так же.
Рабочий вариант без VPN для обеих моделей — SpeShu.AI: доступ и к чат gpt, и к джемини в одном окне, оплата российскими картами и по СБП, русскоязычный интерфейс, стабильный доступ без VPN, регистрация без иностранного номера телефона.
У SpeShu.AI есть аналоговые модели: SpeShu Claude, SpeShu Gemini, SpeShu ChatGPT. Они не уступают официальным моделям и при этом работают без VPN, оплачиваются картой банков РФ и стоят дешевле. Также здесь вы можете протестировать более 300 моделей для текста, фото, видео и музыки.

Что говорят эксперты
По мнению одного из независимых обзоров, GPT-5.4 Mini — более сильный выбор по умолчанию для OpenAI-нативных кодинг-субагентов и воркфлоу с активным использованием инструментов. Гемини же лучше подходит, когда нужна дешевая мультимодальная быстрая модель с контекстом 1M и грандингом на данные Google.
Другой обзор заявляет, что GPT-5.4 выигрывает на агентных терминальных задачах и извлечении из длинного контекста, тогда как Gemini Flash берет лучший результат по computer use, работе с MCP Atlas и по ценовому преимуществу на определенных сценариях.
Есть и более узкая оценка: GPT-5.4 Mini занижает цену обоих конкурентов по стоимости токена, при этом показывая, предположительно, лучший сторонний результат на GPQA среди сравниваемых моделей.
Отдельный источник называет Gemini 3.6 Flash новой дефолтной рабочей лошадкой в семействе Gemini — преемником 3.5 Flash, которую Google рекомендует для большинства продакшн-сценариев именно из-за баланса скорости, контекста и цены.
Итог: что лучше
GPT-5.4 Mini выигрывает:
-
По цене токена — в 1.7 раза дешевле на смешанной нагрузке в 1M входа и 1M выхода.
-
Сильнее на Terminal-Bench при сравнении с предыдущими версиями Flash, на задачах Finance Agent v2, MCP Atlas, MRCR v2 и OmniDocBench 1.5 в сравнении с Gemini 3 Flash.
-
Плюс — нативная интеграция в экосистему OpenAI: Codex, Azure, Bedrock.
Gemini 3.6 Flash выигрывает:
-
По контекстному окну — 1M против 400K, в 2.5 раза больше.
-
Свежее знание — knowledge cutoff на семь месяцев новее.
-
Быстрее — 280–304 токена в секунду.
-
Богаче по мультимодальности — видео, аудио, PDF, встроенный computer use.
-
Немного впереди на SWE-Bench Pro — 58.7% против примерно 57.7% у GPT-5.4 в целом, и заметно впереди на Terminal-Bench 2.1 — 78.0%.
-
Выигрывает на GPQA, Humanity’s Last Exam, MMMU-Pro и Toolathlon при сравнении с предыдущей версией Flash.
-
Плюс — интеграция в GitHub Copilot и экономия в 17% выходных токенов, что снижает реальный счет на длинных задачах сильнее, чем показывает базовая цена за токен.
Для каких задач что выбрать
Не полагайтесь на один сервис под все задачи — разница в контексте, мультимодальности и цене между этими моделями достаточно велика, чтобы выбор реально зависел от типа контента и сценария применения.
GPT-5.4 Mini стоит выбрать, если вы уже работаете в экосистеме OpenAI — через Codex, Azure или Bedrock, если задача чисто текстовая с изображениями и не требует длинного контекста, и если приоритет — минимальная цена за токен на большом объеме коротких запросов.
Gemini 3.6 Flash стоит выбрать, если нужен контекст свыше 400 тысяч токенов, если задача включает аудио, видео или PDF, если важна автоматизация через computer use, и если критична актуальность фоновых знаний модели — например, для задач, завязанных на недавние события или свежие версии технологий.

Как это выглядит на практике: три сценария
Разберем три частых сценария, где разница между моделями проявляется конкретнее, чем в баллах бенчмарков.
Первый — субагентная оркестровка с большим объемом коротких запросов: тысячи однотипных вызовов в день, каждый с небольшим выводом. Здесь базовая цена токена решает почти все, а разница в мультимодальности не имеет значения. GPT-5.4 Mini дешевле в 1.7 раза на смешанной нагрузке, и на масштабе в тысячи запросов эта разница выливается в заметную экономию бюджета за месяц.
Второй — анализ длинного документа целиком: юридический договор на несколько сотен страниц, техническая документация большого проекта, полный репозиторий кода. Здесь контекстное окно у GPT-5.4 Mini в 400 тысяч токенов может попросту не вместить задачу целиком, тогда как миллион токенов у Gemini 3.6 Flash дает запас с большим отрывом. При этом экономия в 17% на выходных токенах у Gemini частично компенсирует более высокую базовую цену — итоговая стоимость обработки длинного документа может оказаться сопоставимой с GPT-5.4 Mini, а иногда и ниже, если задача требует разбивать документ на части при работе с меньшим контекстом.
Третий — обработка видео или аудио: расшифровка встречи, анализ рекламного ролика, автоматизация действий в интерфейсе через computer use. Здесь сравнивать вообще нечего — GPT-5.4 Mini принимает только текст и изображения, и любая задача с видео или звуком автоматически решается только через Gemini 3.6 Flash.
Темп релизов Google: почему это важно для выбора
Google обновляет линейку Flash заметно чаще, чем OpenAI обновляет Mini-версии: между 3.5 Flash и 3.6 Flash прошло всего несколько месяцев, а между 3.6 Flash и 3.7 Flash — три недели. Это значит, что при выборе Gemini для нового продакшн-проекта стоит закладывать более частую проверку актуальной версии и цен, чем при работе с GPT-5.4 Mini, где цикл обновлений исторически растянут на месяцы. Разрыв в 4+ месяца между датами выхода моделей в этом сравнении — прямое следствие разной скорости релизов двух компаний.
Подарок
Хотите на практике сравнить возможности разных языковых моделей на своих задачах — заберите бесплатный гайд «Как выжать 1000% из текстовых нейросетей».

Частые вопросы
Какая нейросеть лучше: GPT-5.4-Mini или Gemini-3.6-Flash? Прямого победителя нет — модели вышли с разрывом в четыре месяца и оптимизированы под разные приоритеты. GPT-5.4 Mini дешевле по цене токена и глубже встроен в экосистему OpenAI. Gemini 3.6 Flash дает вдвое больший контекст, свежее знание и мультимодальность с видео и аудио.
Стоит ли выбирать джемини или чат gpt для работы с длинными документами? Для длинных документов лучше подходит Gemini 3.6 Flash — контекстное окно у нее в 2.5 раза больше, 1 миллион токенов против 400 тысяч у GPT-5.4 Mini, и на тесте длинного контекста GDM-MRCR v2 модель показывает результат почти вдвое выше предшественников.
Актуальна ли еще Gemini 3.6 Flash или ее уже заменили? Формально уже заменили — 13 августа 2026 года Google выпустила Gemini 3.7 Flash, через три недели после 3.6 Flash. При выборе для нового проекта стоит проверять актуальную версию на gemini google, а не ориентироваться на цифры именно 3.6.
Доступны ли chatgpt com и Gemini напрямую из России? Нет, оба сервиса ограничивают доступ для российских пользователей — ни регистрация, ни оплата напрямую российской картой не работают. Рабочий путь без VPN для обеих моделей — агрегаторы вроде SpeShu.AI с оплатой по СБП.
Что выгоднее по цене на большом объеме запросов — GPT-5.4 Mini или Gemini 3.6 Flash? На базовом прайсе GPT-5.4 Mini дешевле в 1.7 раза при равном объеме входа и выхода. Но Gemini 3.6 Flash тратит на 17% меньше выходных токенов на ту же задачу, а на отдельных сложных сценариях экономия токенов доходит до 65%. Итоговая разница на реальной задаче обычно меньше, чем разница в базовой цене за токен, особенно на объемных и сложных запросах.
Можно ли использовать GPT-5.4 Mini или Gemini 3.6 Flash для обработки видео? Только Gemini 3.6 Flash — модель принимает видео, аудио и PDF в качестве входных данных и умеет управлять графическим интерфейсом через встроенный Computer use. GPT-5.4 Mini ограничен текстом и изображениями и для таких задач не подходит вообще.
Заключение
GPT-5.4 Mini и Gemini 3.6 Flash — представители одного бюджетно-скоростного класса, но с разной философией: OpenAI делает ставку на низкую цену токена и интеграцию с собственной экосистемой, Google — на объем контекста, мультимодальность и токенную эффективность на сложных задачах.
Как и в других сравнениях моделей близкого уровня, окончательный выбор редко сводится к одному числу в лидерборде. Он зависит от того, где уже построен ваш продукт: если инфраструктура завязана на OpenAI API, Azure или Bedrock, переход на Gemini ради разницы в контексте может не окупить затраты на миграцию. Если же проект строится с нуля и заранее известно, что понадобится работа с видео, аудио или очень длинными документами, закладывать архитектуру под GPT-5.4 Mini с его 400-тысячным контекстом — заведомо ограничивающее решение.
При выборе для нового проекта стоит помнить, что Gemini 3.6 Flash уже не самая свежая версия в линейке — актуальную цену и характеристики Gemini 3.7 Flash стоит сверять отдельно перед принятием решения. Попробовать обе модели в одном окне, без VPN и с оплатой в рублях, можно на SpeShu.AI.
Для читателей есть приятный бонус. Введите промокод HABRSPESHUAI при пополнении счета агрегатора и получите +15% на балланс.
ссылка на оригинал статьи https://habr.com/ru/articles/1079718/