Пока все ждут очередных мажорных релизов от OpenAI и Anthropic, 20 августа на OpenRouter и OpenCode без лишнего шума появилась анонимная модель с лаконичным названием Ox Alpha. Никто не делал громких анонсов и не публиковал статей на arXiv: модель просто выкатили в паблик с пометкой stealth и предоставили бесплатный доступ всем желающим. Давайте взглянем на нее повнимательнее.
Эндпоинт stealth/ox-alpha сразу привлек внимание сообщества не только бесплатным периодом тестов и заявленной пропускной способностью до 100 триллионов токенов в день, но и характеристиками фронтир-уровня: 1 048 576 токенов входного контекста, до 131 072 токенов на один ответ и поддержкой мультимодальности (текст, фото и видео).
Официально модель называется Ox Alpha, хотя в комьюнити закрепилось написание 0x Alpha (через ноль). Это так называемая stealth-модель, выпущенная анонимно через API-платформы для сбора реального фидбека до официального релиза.
Ключевые характеристики:
-
Контекстное окно: 1 048 576 токенов (1M). Этого достаточно, чтобы загрузить целые репозитории, объемную документацию или длинные логи выполнения задач.
-
Генерация (Output): До 131 072 токенов на один ответ.
-
Мультимодальность: Модель принимает на вход текст, изображения и даже видео, что является большой редкостью для кодинг-моделей. Поддерживает вызов функций (tool calling) и структурированный вывод.
-
Специализация: Разработчик позиционирует ее как reasoning model, созданную для написания кода, длительной автономной работы ИИ-агентов и сурового продакшена.
-
Цена: В период тестирования модель абсолютно бесплатна и имеет огромную пропускную способность вплоть до 100 триллионов токенов в день.
Сравнение с фронтир-моделями
Ox Alpha показывает себя как крепкий середнячок с претензией на лидерство в специфических задачах, хотя результаты бенчмарков расходятся.
На ранних тестах модель показала следующие результаты:
-
Кодинг (AI Coding Daily): В рейтинге от 23 августа 2026 года Ox Alpha заняла 26-е место (8,9 балла из 20). Она уступает флагманам вроде Gemini-3.6-Flash (11,45) и GLM-5.2 (10,3), но обходит Deepseek-V4-Flash (8,2) и Minimax M3 (7,95). Из минусов отмечено долгое время генерации на сложных задачах.
-
Агентная работа (DeepSWE): Независимый исследователь Бен Дэвис протестировал модель на 10 задачах и получил показатель 80% Pass@1. В этом локальном тесте она обошла Claude Fable 5 (65%) и GPT-5.6 Sol (52%). Однако на полном прогоне из 113 задач результаты оказались намного скромнее и выровнялись с показателями GLM-5.3.
-
Общий интеллект (Kingbench): В ранних тестах Ox Alpha набирает около 87,5 баллов, что чуть ниже GLM-5.3 (91,25).
-
Tool Calling Chain: 68 успешных шагов из 69. Самостоятельно исправила 1 ошибку, не уйдя в зацикливание.
-
Безопасность: Модель отличается практически полным отсутствием цензуры (guardrails). В одном из тестов она сгенерировала 4 миллиарда токенов за 4 часа без единой блокировки, хотя в задачах сортировки киберугроз проявила склонность к излишней диагностике, помечая безопасные кейсы как подозрительные.
Главное отличие Ox Alpha от других моделей заключается в способности работать в режиме полноценного цифрового инженера. Она самостоятельно исследует крупные репозитории, локализует логические ошибки в нескольких файлах одновременно и прогоняет тесты. Фильтры безопасности у модели почти полностью отключены: модель свободно пишет эксплоиты, однако, например, готовить по рецептам из Поваренной книги одного анархиста отказывается напрочь (и это к лучшему).
Что это за модель?
Ни одна корпорация не взяла на себя авторство, но спустя двое суток после релиза IT-сообщество практически единогласно приписало разработку китайской лаборатории Zhipu AI (создатели GLM). Вероятнее всего, перед нами экспериментальный дистиллят или Flash-модификация GLM-5.3:
-
Токенизатор: Проверка инструментами вроде
modelprintпоказала 100% совпадение структуры токенизатора с GLM-5.2/5.3 и фиксированное смещение системных промптов ровно в 75 токенов. -
Коды ошибок: При попытке отключения Reasoning-блока API возвращает код
1210(внутренний идентификатор серверов Zhipu AI). -
Обработка видео: Энкодер видеопотока демонстрирует скорость 147 токенов в секунду, что один в один повторяет архитектуру CogVideo.
-
Стиль генерации: Модель сохраняет фирменный паттерн патчинга текста (в среднем 1,3 эмодзи на 1000 символов).
-
Архитектура MoE: Под капотом находится архитектура Mixture of Experts на
744 млрд параметров, из которых при каждом запросе активируются40 млрд.
Все эти технические маркеры полностью совпадают с архитектурой семейства GLM.
Как использовать?
Доступ через OpenRouter полностью бесплатен. Для использования зарегистрируйтесь в OpenRouter и в разделе API Keys создайте новый ключ, который будете использовать только для тестов этой модели. Затем в вашем клиенте (Cursor, Cline, OpenCode) или тестовом фреймворке укажите название stealth/ox-alpha.
Страница модели утверждает, что провайдер не использует данные для обучения, однако общее пользовательское соглашение OpenRouter по программе “Stealth”
разрешаетсбор и передачу ваших промптов анонимным операторам. Никогда не загружайте в подобные модели проприетарный код, API-ключи или пароли.
Стоит ли тащить модель в прод?
Категорически нет. Использовать бесплатное окно в 1M токенов для рефакторинга домашних пет-проектов будет отличной идеей, но тащить туда корпоративный код нельзя. Базовое соглашение OpenRouter для Stealth-моделей позволяет провайдерам сохранять промпты для дообучения.
Заключение
Ox Alpha стала очередным напоминанием о том, как быстро азиатские лаборатории сокращают разрыв с западными фронтир-моделями. Пользуйтесь, пока бесплатно, но следите за тем, что именно вы скармливаете в контекст.
Источник: habr.com