DeepSeek V4.1 Flash — новая мультимодальная модель с контекстом на 1 миллион токенов, анализом изображений и сильными результатами в программировании. В SpeShu.AI модель доступна без VPN и отдельной зарубежной подписки — с оплатой в рублях за фактическое использование.
Flash, которая должна заменить Pro
10 сентября 2026 года DeepSeek выпустила V4.1 Flash. Несмотря на название, это уже не просто облегчённая модель для быстрых ответов: количество параметров выросло с 284 до 552 млрд, появилась новая архитектура, а результаты в нескольких тестах оказались выше, чем у DeepSeek V4 Pro.
Компания уже готовит замену старшей модели. После 12:00 по пекинскому времени 14 сентября запросы к deepseek-v4-pro начнут перенаправляться на V4.1 Flash и оплачивать по тарифу Flash. Такая схема будет действовать до выхода будущей DeepSeek V4.1 Pro.
Получается необычная ситуация: младшая модель становится основной, а версия Pro временно уходит на второй план.
Что такое DeepSeek V4.1 Flash
DeepSeek V4.1 Flash — мультимодальная нейросеть для генерации текста, программирования, анализа документов и распознавания изображений. Она поддерживает обычный режим ответа и режим рассуждений, который включён по умолчанию.
Основные характеристики модели:
-
552 млрд параметров;
-
архитектура Mixture of Experts;
-
8 млрд активных параметров при обработке входных данных;
-
16 млрд активных параметров при генерации ответа;
-
контекстное окно на 1 миллион токенов;
-
максимальный ответ до 384 тысяч токенов;
-
анализ текста и изображений;
-
JSON Output и вызов инструментов;
-
совместимость с OpenAI API и Anthropic API;
-
поддержка Responses API;
-
дополнение кода и работа с репозиториями.
В основе V4.1 Flash лежит новая асимметричная архитектура Causal Encoder–Decoder. Вся модель содержит 552 млрд параметров, но при обработке одного запроса используется только их часть. Такой подход позволяет наращивать возможности нейросети, не увеличивая пропорционально стоимость каждого ответа.
DeepSeek называет V4.1 Flash самой компактной моделью нового архитектурного семейства. Это может означать, что следующие версии линейки окажутся заметно крупнее.
Почему новая архитектура важна для пользователя
Рост с 284 до 552 млрд параметров сам по себе не гарантирует более качественных ответов. Важнее то, сколько параметров модель активирует и сколько ресурсов тратит на обработку контекста.
При работе со входными данными V4.1 Flash использует 8 млрд активных параметров, а при генерации ответа — 16 млрд. Поэтому модель может оставаться быстрой, несмотря на почти двукратное увеличение общего размера.
Также DeepSeek сократила объём памяти, необходимый для KV-кеша. По сравнению с предыдущим поколением модели требуется:
-
в четыре раза меньше памяти HBM;
-
в восемь раз меньше места на SSD.
KV-кеш хранит уже обработанную часть контекста. Когда пользователь продолжает диалог, исправляет код или повторно обращается к документу, нейросети не приходится каждый раз обрабатывать всю историю с нуля.
Для короткого вопроса экономия может быть незаметна. Но в работе с большим репозиторием, длинным PDF или ИИ-агентом доля кешированных токенов становится существенной.
Что изменилось по сравнению с DeepSeek V4 Flash
Предыдущие версии DeepSeek V4 Flash и V4 Flash Vision Experimental выведены из эксплуатации. Теперь текстовые и визуальные возможности объединены в одной модели.
|
Модель |
Параметры |
Изображения |
Статус |
|
DeepSeek V4.1 Flash |
552 млрд |
Поддерживаются |
Актуальная модель |
|
DeepSeek V4 Pro |
[проверить перед публикацией] |
Не поддерживаются |
Будет временно заменена V4.1 Flash |
|
DeepSeek V4 Flash |
284 млрд |
Не поддерживались |
Выведена из эксплуатации |
|
DeepSeek V4 Flash Vision Experimental |
284 млрд |
Поддерживались |
Выведена из эксплуатации |
Для вызова новой версии через официальный API используется название deepseek-flash.
Старые названия deepseek-v4-flash и deepseek-v4-flash-vision-exp пока сохранены для совместимости, но запросы уже направляются на V4.1 Flash. То есть в существующем приложении модель могла обновиться даже без изменения API-настроек.
Как выросли результаты в бенчмарках
Самый заметный прирост произошёл в тестах на программирование и работу с компьютерным окружением.

Terminal-Bench проверяет, насколько хорошо ИИ выполняет реальные задачи через терминал. DeepSWE оценивает работу с программными репозиториями: поиск проблемы, редактирование файлов и подготовку исправлений.
|
Бенчмарк |
V4.1 Flash |
V4 Pro |
|
Terminal-Bench 2.1 |
90,6 |
87,9 |
|
DeepSWE v1.1 |
74,2 |
62,7 |
|
NL2Repo-Bench |
65,4 |
61,5 |
|
CyberGym |
88,1 |
83,3 |
|
Automation-Bench |
54,8 |
31,8 |
|
Agents’ Last Exam |
31,8 |
25,7 |
Сравнение опубликовано самой DeepSeek. Независимые тесты ещё потребуются: результаты зависят от настроек модели, доступных инструментов и количества попыток.
Сколько стоит DeepSeek V4.1 Flash
API оплачивается по количеству использованных токенов. Обязательная ежемесячная подписка не требуется.
|
Тип токенов |
Вне пика |
В пиковые часы |
|
Входные токены из кеша |
$0,003 за 1 млн |
$0,006 за 1 млн |
|
Входные токены без кеша |
$0,15 за 1 млн |
$0,30 за 1 млн |
|
Выходные токены |
$0,60 за 1 млн |
$1,20 за 1 млн |
По сравнению с августовскими тарифами чтение из кеша подешевело примерно на 57%. Однако это не означает, что вся сессия станет дешевле на столько же: итоговая стоимость зависит от соотношения новых, кешированных и выходных токенов.
Пиковые часы действуют по будням:
-
с 04:00 до 07:00 по московскому времени;
-
с 09:00 до 13:00 по московскому времени.
В остальные часы и по выходным применяется льготная цена.
По текущим тарифам V4.1 Flash обходится заметно дешевле V4 Pro: новые входные токены — в 4,4 раза, выходные — в 3,3 раза, чтение из кеша — более чем в семь раз.

Как получить доступ к DeepSeek V4.1 Flash из России
Есть три основных способа.
-
Официальный API DeepSeek. Подходит разработчикам. Потребуются аккаунт, API-ключ и доступный зарубежный способ оплаты.
-
OpenRouter. Модель уже появилась на отдельной странице агрегатора. Через OpenRouter можно подключать разные нейросети к одному API, но условия пополнения баланса и тариф нужно проверить перед запуском.
-
SpeShu.AI. Площадка работает без VPN и позволяет оплачивать запросы российской картой или через СБП. В каталоге собрано более 300 текстовых, визуальных, видео- и аудиомоделей, а платить нужно только за фактическое использование без покупки отдельных подписок.
Прямой API удобнее для интеграции модели в приложение. Российская платформа подойдёт тем, кто хочет открыть нейросеть в браузере, загрузить текст или изображение и сразу начать работу.
Кому пригодится DeepSeek V4.1 Flash
|
Пользователь |
Практическая задача |
|
Студент |
Разобрать учебный материал и составить план подготовки |
|
Автор или копирайтер |
Проанализировать несколько источников и подготовить черновик |
|
Фрилансер |
Превратить переписку с заказчиком в техническое задание |
|
Соискатель |
Адаптировать резюме под вакансию без выдумывания опыта |
|
Аналитик или менеджер |
Сопоставить отчёты и найти расхождения |
|
Разработчик |
Проверить репозиторий, найти ошибку и составить план исправления |
Наиболее интересной модель выглядит для программирования, ИИ-агентов и анализа больших объёмов информации. Контекст на 1 миллион токенов позволяет передавать длинную историю работы, документацию и значительную часть репозитория в рамках одной сессии.
Как использовать DeepSeek V4.1 Flash
Проанализировать длинный документ
Analyze the attached document. Prepare a concise summary, extract all numerical claims, identify contradictions, and cite the source section for every conclusion.
На выходе: краткое содержание, список цифр и найденные противоречия.
Найти ошибку в проекте
Analyze this repository and identify the likely cause of the reported bug. Return the affected files, evidence, reproduction steps, risks, and a minimal fix plan. Do not modify the code.
На выходе: диагностика проблемы без автоматического изменения файлов.
Разобрать изображение или график
Analyze the attached image. Extract all readable text and values, explain the visible relationships, and mark details that cannot be determined reliably.
На выходе: описание изображения с отделением фактов от предположений.
Составить техническое задание
Convert these notes into a technical specification. Include scope, user scenarios, functional requirements, acceptance criteria, dependencies, and open questions.
На выходе: структурированный документ для согласования с заказчиком.
Сравнить несколько отчётов
Compare the attached reports. Create a table with matching findings, contradictions, missing data, risks, and questions that require additional research.
На выходе: таблица расхождений и список данных для проверки.
Подготовить план для ИИ-агента
Create a step-by-step execution plan. For every step, specify the required input, tool, expected result, validation method, and condition for stopping. Do not perform irreversible actions without approval.
На выходе: последовательность действий для автоматизации или агентной системы.
Частые вопросы
Можно ли пользоваться DeepSeek V4.1 Flash бесплатно?
Официальный API работает по токеновой модели оплаты. Наличие бесплатного лимита в веб-интерфейсе или у стороннего сервиса необходимо проверять отдельно.
Принимает ли DeepSeek российские карты?
Возможность прямой оплаты зависит от региона аккаунта. Для пополнения российской картой или через СБП можно использовать российский сервис с рублёвым балансом.
Нужен ли VPN?
При прямом подключении доступ зависит от провайдера и региона аккаунта. Через российскую мультиплатформу модель запускается без VPN.
Может ли модель анализировать изображения?
Да. V4.1 Flash получила нативное визуальное понимание и принимает фотографии, скриншоты, графики и страницы документов.
Заключение
DeepSeek V4.1 Flash интересна не только ростом до 552 млрд параметров. Компания сделала ставку на асимметричную архитектуру, дешёвый кеш и агентные задачи — и теперь готовится временно заменить этой моделью V4 Pro. Новая модель уже доступны в SpeShu.AI. Наши пользователи могут протестировать свежие функции раньше остальных, без трудностей с получением доступа.
ссылка на оригинал статьи https://habr.com/ru/articles/1080698/