Alibaba анонсировали Qwen3.8-Flash-Next — первую публичную модель на архитектуре следующего поколения Qwen4. Открытые веса должны появиться 26 августа в 15:00 UTC.
Несмотря на Qwen3.8 в названии, команда прямо называет модель предварительным показом Qwen4. Её выпускают заранее, чтобы разработчики библиотек и систем инференса могли подготовиться к полноценному релизу нового поколения.

Официально пока известно немного. Это мультимодальная MoE-модель, которая выйдет в обычной и FP8-версиях.
В первой версии страницы ModelScope было более подробное описание, но затем его убрали. Текст сохранился в скриншотах и цитатах пользователей. Если он верен, модель получила:
-
125 млрд основных параметров
-
дополнительные 51 млрд параметров N-gram embeddings
-
6 млрд активных параметров на токен
-
изменения в attention, residual-связях, embeddings и оптимизации
Там же утверждалось, что обучение Flash-Next потребовало примерно в девять раз меньше вычислений, чем Qwen3.7-Plus. Общие возможности якобы остались сопоставимыми, а программирование и cowork-задачи стали сильнее. Таблицы с результатами при этом не было.
Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI‑агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!
Источник: habr.com