Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

В API модель стоит $2 за миллион входных и $6 за миллион выходных токенов. Это в 2,5 раза дешевле Kimi K3 по генерации и больше чем в четыре раза дешевле Claude Opus 5.
Веса Qwen3.8-Max обещают опубликовать на Hugging Face и ModelScope на следующей неделе. Это будет первая модель Max-класса от Qwen с открытыми весами. Вместе с ней команда пообещала открыть веса Qwen3.8-27B.
Как Qwen3.8-Max выглядит на фоне Kimi K3 и Opus 5
Qwen не включили вышедшие в июле Kimi K3 и Claude Opus 5 в свою сравнительную таблицу. Ниже я свёл результаты из трёх публикаций разработчиков и независимого прогона Terminal-Bench 2.1.
|
Бенчмарк |
Qwen3.8-Max |
Kimi K3 |
Claude Opus 5 |
|---|---|---|---|
|
Terminal-Bench 2.1 |
86,6% |
88,3% |
89,1% |
|
DeepSWE v1.1 |
56,6% |
67,5% |
68,8% |
|
Humanity’s Last Exam, без инструментов |
43,6% |
43,5% |
56,3% |
|
Humanity’s Last Exam, с инструментами |
56,2% |
56,0% |
64,7% |
|
AutomationBench |
27,3%† |
30,8% |
26,0% |
На Terminal-Bench 2.1 новая Qwen отстаёт от Kimi K3 на 1,7 процентного пункта, от Opus 5 на 2,5 пункта. На DeepSWE разрыв заметнее: 10,9 пункта до Kimi и 12,2 пункта до Opus 5.
На Humanity’s Last Exam Qwen3.8-Max и Kimi K3 идут практически вровень.
2,4 трлн параметров против 2,8 трлн у Kimi
|
Модель |
Всего параметров |
Активно на токен |
Контекст |
Вход |
Выход |
Чтение кэша |
Веса |
|---|---|---|---|---|---|---|---|
|
Qwen3.8-Max |
2,4 трлн |
95 млрд |
1 млн |
$2 |
$6 |
$0,25 |
обещаны на следующей неделе |
|
Kimi K3 |
2,8 трлн |
104 млрд |
1 млн |
$3 |
$15 |
$0,30 |
опубликованы |
|
Claude Opus 5 |
не раскрыто |
не раскрыто |
1 млн |
$5 |
$25 |
$0,50 |
закрыты |
Цены указаны за миллион токенов. У Qwen используется неявное кэширование, у Kimi и Claude в таблице указана цена чтения уже созданного кэша.
По общему числу параметров Qwen3.8-Max немного меньше Kimi K3, но на токене задействует сопоставимый объём модели: 95 млрд против 104 млрд. Архитектурные подробности Qwen пока не опубликовали, кроме связи с Qwen3.5.
16 дней автономной разработки
Главным примером агентного программирования Qwen называют oh-my-cli, CLI-агент на TypeScript. Модель получила пустую папку и больше десяти дней развивала проект без ручного управления.
На 30 июля, после примерно 16 дней автономной работы, в репозитории было 265 коммитов, 127 PR и 151 issue. Агент собирал требования из отзывов и собственных тестов, превращал их в задачи, писал код, запускал сборку, unit-, E2E- и lifecycle-тесты, затем возвращал ошибки в очередь на исправление.

API и доступность
Идентификатор модели в API: qwen3.8-max. Поддерживаются OpenAI-совместимые Chat Completions и Responses API, а также протокол Anthropic. Модель можно подключить к Claude Code, Codex, Qoder CLI, Qwen Code и OpenClaw.
Глубина рассуждений регулируется через reasoning_effort: доступны low, medium и xhigh, последний используется по умолчанию. Сохранение истории рассуждений между ходами, preserve_thinking, также включено по умолчанию.
Попробовать модель можно в Qwen Studio и через QwenCloud. Лицензию будущих открытых весов и требования к развёртыванию команда пока не опубликовала.
Источники: анонс Qwen3.8-Max, репозиторий автономного проекта, модель и бенчмарки Kimi K3, анонс Claude Opus 5, system card Claude Opus 5, Terminal-Bench 2.1 от Artificial Analysis, цены Kimi K3, цены Claude API.
Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI‑агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!
ссылка на оригинал статьи https://habr.com/ru/articles/1065884/