Ox Alpha – кто ты, воин?

Пока все ждут очередных мажорных релизов от OpenAI и Anthropic, 20 августа на OpenRouter и OpenCode без лишнего шума появилась анонимная модель с лаконичным названием Ox Alpha. Никто не делал громких анонсов и не публиковал статей на arXiv: модель просто выкатили в паблик с пометкой stealth и предоставили бесплатный доступ всем желающим. Давайте взглянем на нее повнимательнее.

Эндпоинт stealth/ox-alpha сразу привлек внимание сообщества не только бесплатным периодом тестов и заявленной пропускной способностью до 100 триллионов токенов в день, но и характеристиками фронтир-уровня: 1 048 576 токенов входного контекста, до 131 072 токенов на один ответ и поддержкой мультимодальности (текст, фото и видео).

Официально модель называется Ox Alpha, хотя в комьюнити закрепилось написание 0x Alpha (через ноль). Это так называемая stealth-модель, выпущенная анонимно через API-платформы для сбора реального фидбека до официального релиза.

Ключевые характеристики:

  • Контекстное окно: 1 048 576 токенов (1M). Этого достаточно, чтобы загрузить целые репозитории, объемную документацию или длинные логи выполнения задач.

  • Генерация (Output): До 131 072 токенов на один ответ.

  • Мультимодальность: Модель принимает на вход текст, изображения и даже видео, что является большой редкостью для кодинг-моделей. Поддерживает вызов функций (tool calling) и структурированный вывод.

  • Специализация: Разработчик позиционирует ее как reasoning model, созданную для написания кода, длительной автономной работы ИИ-агентов и сурового продакшена.

  • Цена: В период тестирования модель абсолютно бесплатна и имеет огромную пропускную способность вплоть до 100 триллионов токенов в день.

Сравнение с фронтир-моделями

Ox Alpha показывает себя как крепкий середнячок с претензией на лидерство в специфических задачах, хотя результаты бенчмарков расходятся.

На ранних тестах модель показала следующие результаты:

  • Кодинг (AI Coding Daily): В рейтинге от 23 августа 2026 года Ox Alpha заняла 26-е место (8,9 балла из 20). Она уступает флагманам вроде Gemini-3.6-Flash (11,45) и GLM-5.2 (10,3), но обходит Deepseek-V4-Flash (8,2) и Minimax M3 (7,95). Из минусов отмечено долгое время генерации на сложных задачах.

  • Агентная работа (DeepSWE): Независимый исследователь Бен Дэвис протестировал модель на 10 задачах и получил показатель 80% Pass@1. В этом локальном тесте она обошла Claude Fable 5 (65%) и GPT-5.6 Sol (52%). Однако на полном прогоне из 113 задач результаты оказались намного скромнее и выровнялись с показателями GLM-5.3.

  • Общий интеллект (Kingbench): В ранних тестах Ox Alpha набирает около 87,5 баллов, что чуть ниже GLM-5.3 (91,25).

  • Tool Calling Chain: 68 успешных шагов из 69. Самостоятельно исправила 1 ошибку, не уйдя в зацикливание.

  • Безопасность: Модель отличается практически полным отсутствием цензуры (guardrails). В одном из тестов она сгенерировала 4 миллиарда токенов за 4 часа без единой блокировки, хотя в задачах сортировки киберугроз проявила склонность к излишней диагностике, помечая безопасные кейсы как подозрительные.

Главное отличие Ox Alpha от других моделей заключается в способности работать в режиме полноценного цифрового инженера. Она самостоятельно исследует крупные репозитории, локализует логические ошибки в нескольких файлах одновременно и прогоняет тесты. Фильтры безопасности у модели почти полностью отключены: модель свободно пишет эксплоиты, однако, например, готовить по рецептам из Поваренной книги одного анархиста отказывается напрочь (и это к лучшему).

Что это за модель?

Ни одна корпорация не взяла на себя авторство, но спустя двое суток после релиза IT-сообщество практически единогласно приписало разработку китайской лаборатории Zhipu AI (создатели GLM). Вероятнее всего, перед нами экспериментальный дистиллят или Flash-модификация GLM-5.3:

  • Токенизатор: Проверка инструментами вроде modelprint показала 100% совпадение структуры токенизатора с GLM-5.2/5.3 и фиксированное смещение системных промптов ровно в 75 токенов.

  • Коды ошибок: При попытке отключения Reasoning-блока API возвращает код 1210 (внутренний идентификатор серверов Zhipu AI).

  • Обработка видео: Энкодер видеопотока демонстрирует скорость 147 токенов в секунду, что один в один повторяет архитектуру CogVideo.

  • Стиль генерации: Модель сохраняет фирменный паттерн патчинга текста (в среднем 1,3 эмодзи на 1000 символов).

  • Архитектура MoE: Под капотом находится архитектура Mixture of Experts на 744 млрд параметров, из которых при каждом запросе активируются 40 млрд.

Все эти технические маркеры полностью совпадают с архитектурой семейства GLM.

Как использовать?

Доступ через OpenRouter полностью бесплатен. Для использования зарегистрируйтесь в OpenRouter и в разделе API Keys создайте новый ключ, который будете использовать только для тестов этой модели. Затем в вашем клиенте (Cursor, Cline, OpenCode) или тестовом фреймворке укажите название stealth/ox-alpha.

Страница модели утверждает, что провайдер не использует данные для обучения, однако общее пользовательское соглашение OpenRouter по программе “Stealth” разрешает сбор и передачу ваших промптов анонимным операторам. Никогда не загружайте в подобные модели проприетарный код, API-ключи или пароли.

Стоит ли тащить модель в прод?

Категорически нет. Использовать бесплатное окно в 1M токенов для рефакторинга домашних пет-проектов будет отличной идеей, но тащить туда корпоративный код нельзя. Базовое соглашение OpenRouter для Stealth-моделей позволяет провайдерам сохранять промпты для дообучения.

Заключение

Ox Alpha стала очередным напоминанием о том, как быстро азиатские лаборатории сокращают разрыв с западными фронтир-моделями. Пользуйтесь, пока бесплатно, но следите за тем, что именно вы скармливаете в контекст.

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев