В то время как западные гиганты вроде OpenAI и Anthropic продолжают соревноваться в гонке интеллектов, китайская Alibaba Cloud сделала неожиданно сильный ход, сделав ставку не просто на «ум», а на «самостоятельность».
Новая флагманская модель Qwen 3.8 Max, по данным MIT Technology Review, продемонстрировала то, что многие эксперты называют «новым уровнем цифровой автономии». Судя по демонстрациям, перед нами уже не просто чат-бот, способный поддержать беседу, а трудоголик, готовый работать без сна и выходных.
Шестнадцатидневный марафон без единого клика
Самый громкий эксперимент длился 16 дней. В течение этого срока Qwen 3.8 Max в одиночку вела разработку крупного программного проекта без какого-либо вмешательства человека. Модель не просто писала код, а прошла полный цикл разработки, начиная от постановки задачи и заканчивая созданием собственного инструментального фреймворка, включая тесты и исправления. Это похоже на стажировку, где стажер не только выполняет задания, но и сам придумывает себе инструменты для работы. Для сравнения, большинство современных ИИ сдаются после пары часов сложных многошаговых инструкций.
Но на этом эксперименты не закончились. В другом тестовом сценарии модель занялась проектированием криптографических чипов. После сотен итераций она сократила количество логических вентилей с 8298 до 678. В индустрии это называется «нетривиальной оптимизацией», которая обычно занимает у инженеров недели.
Архитектура, где качество не жертвует скоростью
Секрет этой выносливости кроется в архитектуре. Qwen 3.8 Max использует технологию Mixture of Experts, динамическое распределение экспертов. Формально модель огромна — 2,4 триллиона параметров. Однако для обработки каждого конкретного запроса активируется лишь малая часть, около 95 миллиардов нейронов. Это позволяет сохранять глубину мышления, характерную для больших моделей, но при этом работать быстро, не тратя вычислительные ресурсы на «спящие» участки сети. Иными словами, это не один большой мозг, а целый штат узких специалистов, подключающихся по мере необходимости.
Впереди на шаг в бенчмарках
В цифровых тестах новинка смотрится уверенно. В сложнейшем академическом тесте на логическое мышление GPQA Diamond модель набрала 92,6 балла, что, по данным ресурса VentureBeat, выводит её на один уровень с сильнейшей моделью Claude Fable 5. Однако особенно впечатляющими стали результаты в практических дисциплинах. В тестах по работе с Linux-терминалом и в сложных агентных сценариях программирования Qwen 3.8 Max оказалась впереди большинства платных конкурентов. Например, приняв участие в ML-конкурсе WWW2025, модель разобралась с задачей за 24 часа и обошла 87 процентов команд, состоящих из живых специалистов.
Открытость как главный козырь
Главная интригазаключается в том, что Alibaba планирует открыть веса модели. Это фактически делает Qwen 3.8 Max крупнейшей доступной открытой нейросетью в мире. Компании смогут устанавливать её на свои серверы и дообучать под внутренние задачи, что закрывает главную проблему корпоративного сектора — утечку данных через сторонние API. В России новинка уже доступна через локальные агрегаторы ИИ-услуг, и первые отзывы пользователей, по данным платформы chad, указывают на высокий спрос именно у разработчиков. Стартап CodeRabbit, исправляющий ИИ-ошибки в коде, оценен в $1,5 млрд в рамках раунда финансирования Репутационные ловушки банковской рекламы в Telegram Кризис в Wildberries. Что изменится в сфере электронной торговли?
Похоже, что Китай делает ставку не на создание «волшебного ассистента», а на «инженера», способного сутками копаться в коде или чертежах. И если 16 дней автономной работы — это только начало, то очень скоро термин «программист» приобретет новое звучание.
Источник: www.it-world.ru