Пока все ждут очередных мажорных релизов от OpenAI и Anthropic, 20 августа на OpenRouter и OpenCode без лишнего шума появилась анонимная модель с лаконичным названием Ox Alpha. Никто не делал громких анонсов и не публиковал статей на arXiv: модель просто выкатили в паблик с пометкой stealth и предоставили бесплатный доступ всем желающим. Давайте взглянем на нее повнимательнее.

Эндпоинт stealth/ox-alpha сразу привлёк внимание сообщества не только бесплатным периодом тестов и заявленной пропускной способностью до 100 триллионов токенов в день, но и характеристиками фронтир‑уровня: 1 048 576 токенов входного контекста, до 131 072 токенов на один ответ и поддержкой мультимодальности (текст, фото и видео).

Официально модель называется Ox Alpha, хотя в комьюнити закрепилось написание 0x Alpha (через ноль). Это так называемая stealth‑модель, выпущенная анонимно через API‑платформы для сбора реального фидбека до официального релиза.

Ключевые характеристики:

  • Контекстное окно: 1 048 576 токенов (1M). Этого достаточно, чтобы загрузить целые репозитории, объемную документацию или длинные логи выполнения задач.

  • Генерация (Output): до 131 072 токенов на один ответ.

  • Мультимодальность: модель принимает на вход текст, изображения и даже видео, что является большой редкостью для кодинг‑моделей. Поддерживает вызов функций (tool calling) и структурированный вывод.

  • Специализация: разработчик позиционирует её как reasoning model, созданную для написания кода, длительной автономной работы ИИ‑агентов и сурового продакшена.

  • Цена: в период тестирования модель абсолютно бесплатна и имеет огромную пропускную способность вплоть до 100 триллионов токенов в день.

Сравнение с фронтир‑моделями

Ox Alpha показывает себя как крепкий середнячок с претензией на лидерство в специфических задачах, хотя результаты бенчмарков расходятся.

На ранних тестах модель показала следующие результаты:

  • Кодинг (AI Coding Daily): в рейтинге от 23 августа 2026 года Ox Alpha заняла 26-е место (8,9 балла из 20). Она уступает флагманам вроде Gemini-3.6-Flash (11,45) и GLM-5.2 (10,3), но обходит Deepseek‑V4-Flash (8,2) и Minimax M3 (7,95). Из минусов отмечено долгое время генерации на сложных задачах.

  • Агентная работа (DeepSWE): независимый исследователь Бен Дэвис протестировал модель на 10 задачах и получил показатель 80% Pass@1. В этом локальном тесте она обошла Claude Fable 5 (65%) и GPT-5.6 Sol (52%). Однако на полном прогоне из 113 задач результаты оказались намного скромнее и выровнялись с показателями GLM-5.3.

  • Общий интеллект (Kingbench): в ранних тестах Ox Alpha набирает около 87,5 баллов, что чуть ниже GLM-5.3 (91,25).

  • Tool Calling Chain: 68 успешных шагов из 69. Самостоятельно исправила 1 ошибку, не уйдя в зацикливание.

  • Безопасность: модель отличается практически полным отсутствием цензуры (guardrails). В одном из тестов она сгенерировала 4 миллиарда токенов за 4 часа без единой блокировки, хотя в задачах сортировки киберугроз проявила склонность к излишней диагностике, помечая безопасные кейсы как подозрительные.

Главное отличие Ox Alpha от других моделей заключается в способности работать в режиме полноценного цифрового инженера. Она самостоятельно исследует крупные репозитории, локализует логические ошибки в нескольких файлах одновременно и прогоняет тесты. Фильтры безопасности у модели почти полностью отключены: модель свободно пишет эксплоиты, однако, например, готовить по рецептам из Поваренной книги одного анархиста отказывается напрочь (и это к лучшему).

Что это за модель?

Ни одна корпорация не взяла на себя авторство, но спустя двое суток после релиза IT‑сообщество практически единогласно приписало разработку китайской лаборатории Zhipu AI (создатели GLM). Вероятнее всего, перед нами экспериментальный дистиллят или Flash‑модификация GLM-5.3:

  • Токенизатор: проверка инструментами вроде modelprint показала 100% совпадение структуры токенизатора с GLM-5.2/5.3 и фиксированное смещение системных промптов ровно в 75 токенов.

  • Коды ошибок: при попытке отключения Reasoning‑блока API возвращает код 1210 (внутренний идентификатор серверов Zhipu AI).

  • Обработка видео: энкодер видеопотока демонстрирует скорость 147 токенов в секунду, что один в один повторяет архитектуру CogVideo.

  • Стиль генерации: модель сохраняет фирменный паттерн патчинга текста (в среднем 1,3 эмодзи на 1000 символов).

  • Архитектура MoE: под капотом находится архитектура Mixture of Experts на 744 млрд параметров, из которых при каждом запросе активируются 40 млрд.

Все эти технические маркеры полностью совпадают с архитектурой семейства GLM.

Как использовать?

Доступ через OpenRouter полностью бесплатен. Для использования зарегистрируйтесь в OpenRouter и в разделе API Keys создайте новый ключ, который будете использовать только для тестов этой модели. Затем в вашем клиенте (Cursor, Cline, OpenCode) или тестовом фреймворке укажите название stealth/ox-alpha.

Страница модели утверждает, что провайдер не использует данные для обучения, однако общее пользовательское соглашение OpenRouter по программе «Stealth» разрешает сбор и передачу ваших промптов анонимным операторам. Никогда не загружайте в подобные модели проприетарный код, API‑ключи или пароли.

Стоит ли тащить модель в прод?

Категорически нет. Использовать бесплатное окно в 1M токенов для рефакторинга домашних пет‑проектов будет отличной идеей, но тащить туда корпоративный код нельзя. Базовое соглашение OpenRouter для Stealth‑моделей позволяет провайдерам сохранять промпты для дообучения.

Заключение

Ox Alpha стала очередным напоминанием о том, как быстро азиатские лаборатории сокращают разрыв с западными фронтир‑моделями. Пользуйтесь, пока бесплатно, но следите за тем, что именно вы скармливаете в контекст.

Update от 26.08.2026: период бесплатного тестирования модели окончен. При попыке вызова модель возвращает:

{
	"message": "Thank you for participating in the Stealth Ox Alpha testing period. This model was ZAI's GLM-5.3 Flash. Use it now: https://openrouter.ai/z-ai/glm-5.3-flash",
	"code": 404
}

Это действительно была GLM-5.3 Flash. Дело раскрыто.