Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

В API модель стоит $2 за миллион входных и $6 за миллион выходных токенов. Это в 2,5 раза дешевле Kimi K3 по генерации и больше чем в четыре раза дешевле Claude Opus 5.
Веса Qwen3.8-Max обещают опубликовать на Hugging Face и ModelScope на следующей неделе. Это будет первая модель Max-класса от Qwen с открытыми весами. Вместе с ней команда пообещала открыть веса Qwen3.8-27B.
Как Qwen3.8-Max выглядит на фоне Kimi K3 и Opus 5
Qwen не включили вышедшие в июле Kimi K3 и Claude Opus 5 в свою сравнительную таблицу. Ниже я свёл результаты из трёх публикаций разработчиков и независимого прогона Terminal-Bench 2.1.
Бенчмарк
Qwen3.8-Max
Kimi K3
Claude Opus 5
Terminal-Bench 2.1
86,6%
88,3%
89,1%
DeepSWE v1.1
56,6%
67,5%
68,8%
Humanity’s Last Exam, без инструментов
43,6%
43,5%
56,3%
Humanity’s Last Exam, с инструментами
56,2%
56,0%
64,7%
AutomationBench
27,3%†
30,8%
26,0%
На Terminal-Bench 2.1 новая Qwen отстаёт от Kimi K3 на 1,7 процентного пункта, от Opus 5 на 2,5 пункта. На DeepSWE разрыв заметнее: 10,9 пункта до Kimi и 12,2 пункта до Opus 5.
На Humanity’s Last Exam Qwen3.8-Max и Kimi K3 идут практически вровень.
2,4 трлн параметров против 2,8 трлн у Kimi
Модель
Всего параметров
Активно на токен
Контекст
Вход
Выход
Чтение кэша
Веса
Qwen3.8-Max
2,4 трлн
95 млрд
1 млн
$2
$6
$0,25
обещаны на следующей неделе
Kimi K3
2,8 трлн
104 млрд
1 млн
$3
$15
$0,30
опубликованы
Claude Opus 5
не раскрыто
не раскрыто
1 млн
$5
$25
$0,50
закрыты
Цены указаны за миллион токенов. У Qwen используется неявное кэширование, у Kimi и Claude в таблице указана цена чтения уже созданного кэша.
По общему числу параметров Qwen3.8-Max немного меньше Kimi K3, но на токене задействует сопоставимый объём модели: 95 млрд против 104 млрд. Архитектурные подробности Qwen пока не опубликовали, кроме связи с Qwen3.5.
16 дней автономной разработки
Главным примером агентного программирования Qwen называют oh-my-cli, CLI-агент на TypeScript. Модель получила пустую папку и больше десяти дней развивала проект без ручного управления.
На 30 июля, после примерно 16 дней автономной работы, в репозитории было 265 коммитов, 127 PR и 151 issue. Агент собирал требования из отзывов и собственных тестов, превращал их в задачи, писал код, запускал сборку, unit-, E2E- и lifecycle-тесты, затем возвращал ошибки в очередь на исправление.

API и доступность
Идентификатор модели в API: qwen3.8-max. Поддерживаются OpenAI-совместимые Chat Completions и Responses API, а также протокол Anthropic. Модель можно подключить к Claude Code, Codex, Qoder CLI, Qwen Code и OpenClaw.
Глубина рассуждений регулируется через reasoning_effort: доступны low, medium и xhigh, последний используется по умолчанию. Сохранение истории рассуждений между ходами, preserve_thinking, также включено по умолчанию.
Попробовать модель можно в Qwen Studio и через QwenCloud. Лицензию будущих открытых весов и требования к развёртыванию команда пока не опубликовала.
Источники: анонс Qwen3.8-Max, репозиторий автономного проекта, модель и бенчмарки Kimi K3, анонс Claude Opus 5, system card Claude Opus 5, Terminal-Bench 2.1 от Artificial Analysis, цены Kimi K3, цены Claude API.
Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI‑агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!
Источник: habr.com