Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге

Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов.

В API модель стоит $2 за миллион входных и $6 за миллион выходных токенов. Это в 2,5 раза дешевле Kimi K3 по генерации и больше чем в четыре раза дешевле Claude Opus 5.

Веса Qwen3.8-Max обещают опубликовать на Hugging Face и ModelScope на следующей неделе. Это будет первая модель Max-класса от Qwen с открытыми весами. Вместе с ней команда пообещала открыть веса Qwen3.8-27B.

Как Qwen3.8-Max выглядит на фоне Kimi K3 и Opus 5

Qwen не включили вышедшие в июле Kimi K3 и Claude Opus 5 в свою сравнительную таблицу. Ниже я свёл результаты из трёх публикаций разработчиков и независимого прогона Terminal-Bench 2.1.

Бенчмарк

Qwen3.8-Max

Kimi K3

Claude Opus 5

Terminal-Bench 2.1

86,6%

88,3%

89,1%

DeepSWE v1.1

56,6%

67,5%

68,8%

Humanity’s Last Exam, без инструментов

43,6%

43,5%

56,3%

Humanity’s Last Exam, с инструментами

56,2%

56,0%

64,7%

AutomationBench

27,3%†

30,8%

26,0%

На Terminal-Bench 2.1 новая Qwen отстаёт от Kimi K3 на 1,7 процентного пункта, от Opus 5 на 2,5 пункта. На DeepSWE разрыв заметнее: 10,9 пункта до Kimi и 12,2 пункта до Opus 5.

На Humanity’s Last Exam Qwen3.8-Max и Kimi K3 идут практически вровень.

2,4 трлн параметров против 2,8 трлн у Kimi

Модель

Всего параметров

Активно на токен

Контекст

Вход

Выход

Чтение кэша

Веса

Qwen3.8-Max

2,4 трлн

95 млрд

1 млн

$2

$6

$0,25

обещаны на следующей неделе

Kimi K3

2,8 трлн

104 млрд

1 млн

$3

$15

$0,30

опубликованы

Claude Opus 5

не раскрыто

не раскрыто

1 млн

$5

$25

$0,50

закрыты

Цены указаны за миллион токенов. У Qwen используется неявное кэширование, у Kimi и Claude в таблице указана цена чтения уже созданного кэша.

По общему числу параметров Qwen3.8-Max немного меньше Kimi K3, но на токене задействует сопоставимый объём модели: 95 млрд против 104 млрд. Архитектурные подробности Qwen пока не опубликовали, кроме связи с Qwen3.5.

16 дней автономной разработки

Главным примером агентного программирования Qwen называют oh-my-cli, CLI-агент на TypeScript. Модель получила пустую папку и больше десяти дней развивала проект без ручного управления.

На 30 июля, после примерно 16 дней автономной работы, в репозитории было 265 коммитов, 127 PR и 151 issue. Агент собирал требования из отзывов и собственных тестов, превращал их в задачи, писал код, запускал сборку, unit-, E2E- и lifecycle-тесты, затем возвращал ошибки в очередь на исправление.

API и доступность

Идентификатор модели в API: qwen3.8-max. Поддерживаются OpenAI-совместимые Chat Completions и Responses API, а также протокол Anthropic. Модель можно подключить к Claude Code, Codex, Qoder CLI, Qwen Code и OpenClaw.

Глубина рассуждений регулируется через reasoning_effort: доступны low, medium и xhigh, последний используется по умолчанию. Сохранение истории рассуждений между ходами, preserve_thinking, также включено по умолчанию.

Попробовать модель можно в Qwen Studio и через QwenCloud. Лицензию будущих открытых весов и требования к развёртыванию команда пока не опубликовала.

Источники: анонс Qwen3.8-Max, репозиторий автономного проекта, модель и бенчмарки Kimi K3, анонс Claude Opus 5, system card Claude Opus 5, Terminal-Bench 2.1 от Artificial Analysis, цены Kimi K3, цены Claude API.

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI‑агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев