← На главную
Новости· 22.08.2026· 7 мин чтения

Ox Alpha: бесплатная модель с 1 млн токенов уже крутится в Claude Code — автор неизвестен

20 августа на OpenRouter появилась stealth/ox-alpha: 1 млн токенов, видео на входе и цена $0. Лаборатория молчит, Claude Code уже жжёт сотни миллиардов токенов.

Стилизованная чёрная маска быка на столе в серверной — обложка к статье про stealth-модель Ox Alpha
Материал подготовлен с помощью ИИ и проверен редактором

20 августа 2026 года OpenRouter без пресс-релиза положил в каталог модель stealth/ox-alpha. Карточка короткая: reasoning-модель для кода, длинных агентных сессий и продакшен-нагрузки. Контекст — 1 048 576 токенов. На вход — текст, картинки и видео. Цена на превью — ноль. Имя лаборатории в карточке не написано.

Через двое суток по Stealth-эндпоинту прошло почти 5 триллионов токенов. В списке приложений — Hermes Agent, Claude Code, DeepSeek Harness и ZCode. Это уже не «потыкать в playground».

Что лежит в карточке — и чего в ней нет

OpenRouter прямо пишет: он только маршрутизирует запросы. Разработчик — третья сторона, которая на время превью осталась анонимной. Промпты и ответы провайдер хранит, но не использует для обучения. Это не то же самое, что «никто не читает». Если бы вы не отправили закрытый репозиторий безымянной лаборатории за деньги, бесплатный миллион токенов это не чинит.

Живые цифры с карточки на 22 августа:

  • идентификатор: stealth/ox-alpha
  • контекст: 1 048 576 токенов, максимум ответа — 131 072
  • вход: текст, изображение, видео; выход — только текст
  • цена: $0 за миллион входных и выходных токенов
  • reasoning включён всегда, дефолт — max (можно опустить до high или low, выключить нельзя)
  • tool calling: параметры tools и tool_choice
  • JSON через response_format, без жёсткой проверки JSON Schema
  • один бэкенд, failover нет
  • аптайм за трое суток около 99,99%, availability около 99,52%
  • медианная задержка около 7 секунд, скорость письма около 18 токенов в секунду

OpenCode отдельно пообещал примерно неделю «почти безлимитного» доступа и заявил ёмкость в 100 триллионов токенов в сутки. Это рекламный потолок провайдера, не бенчмарк качества. Свободное окно временное: stealth-модели на OpenRouter так и живут, пока лаборатория смотрит живой трафик.

Почему это интересно именно агентам

Позиционирование карточки — не чат, а длинный инженерный цикл: репозиторий, план, правки файлов, команды, тесты, снова правки. Миллион токенов теоретически позволяет держать в одном запросе большую часть проекта, скриншоты интерфейса и даже кусок видео с багом.

Это совпадает с тем, кто её уже жжёт. На вкладке Apps у OpenRouter 22 августа:

  • Hermes Agent — около 728 млрд токенов
  • Claude Code — около 433 млрд
  • omp — около 361 млрд
  • DeepSeek Harness — около 349 млрд
  • ZCode, терминальный агент Z.ai — около 170 млрд

Hermes Agent уже вписал stealth/ox-alpha в каталог как бесплатную reasoning-модель с таймаутом 300 секунд. Для сценария вроде Claude Code это прямой кандидат на «давайте прогоним тот же репозиторий, пока это ноль долларов».

Нюанс по железу цикла: reasoning нельзя выключить. На длинной сессии это бьёт по времени сильнее, чем по счёту. 18 токенов в секунду — не Sonnet и не Flash.

Кто её сделал. Короткий ответ: никто не подтвердил

В X уже две любимые теории: «это следующий GLM со зрением» и «это слив Claude». Ни одна не стоит в карточке.

Что можно сказать, не выдавая догадку за факт:

  • OpenRouter так делал раньше. Pony Alpha в феврале 2026 позже оказался GLM-5 от Zhipu / Z.ai. Owl Alpha — LongCat-2.0-Preview от Meituan. Лаборатории сами выходили из тени, OpenRouter никого не «разоблачал».
  • У публичного GLM-5.3 совпадают странные детали карточки: те же 1 048 576 / 131 072, reasoning обязателен, те же ступени max / high / low, те же temperature 1.0 и top_p 0.95. Разница важная: GLM-5.3 ест только текст, Ox Alpha — ещё картинки и видео.
  • Разработчик dax прогнал tokenizer fingerprint на 25 промптах: сырые подсчёты токенов у Ox Alpha почти совпали с GLM-5.3, со сдвигом примерно на 75 токенов обёртки.
  • ZCode, собственный coding-агент Z.ai, уже в топе потребителей. Это аргумент «ну конечно GLM», не доказательство.
  • Вторая кандидатура, которую обсуждают, — Xiaomi / MiMo: у них уже был Hunter Alpha, потом раскрытый как MiMo-V2-Pro. Спека — миллион токенов, мультимодальность, уклон в агентов — тоже ложится.
  • Сама модель в identity-пробах представляется как «ox-alpha, developed by an undisclosed organization» и отказывается назваться GPT, Claude, Gemini, Grok, GLM, Qwen или Kimi.

Я бы не ставил деньги на конкретную табличку. Паттерн китайских stealth-дропов на OpenRouter есть. «Это точно GLM-5.5» — пока чужой тред, не первоисточник. Мы уже разбирали открытый GLM-5.2: даже когда имя известно, это всё ещё другая история, чем анонимный превью-эндпоинт.

Бенчмарки: вирусные 80% и один честный прогон

Независимых публичных лидербордов почти нет. ModelCap 22 августа прямо пишет: admitted measured evidence — ноль. Их позиция #168 — заглушка по архитектуре, не оценка качества.

Что успели прогнать энтузиасты — с оговорками:

  • Полный DeepSWE, 113 задач, harness pier плюс mini-swe-agent, лог MatchaOnMuffins: 66 из 113, то есть 58,4% resolve rate. Средний partial 0,94: в 80% задач модель закрыла не меньше 90% fail-to-pass тестов, но бинарный скоринг это прячет. 11 эпизодов — 9,7% всего бенча — умерли не от «тупости», а потому что модель три раза подряд ответила без tool call. Прогон шёл 20 часов 39 минут и стоил $0. Кэш попал в 96% входных токенов.
  • Ранние посты про «80% DeepSWE, впереди Claude Fable 5 и GPT-5.6-sol» опирались на короткий срез примерно из десяти задач. Это не тот же бенчмарк.
  • SMF Official A, 157 тестов: 127 из 157, 80,9%. Для ориентира, в той же таблице Grok 4.6 — 153 из 157, Kimi K3 — 140 из 157, DeepSeek V4 Pro — 128 из 157. Письмо и инструменты — чисто, картинки модель реально видит, а не галлюцинирует подписи.
  • Kingbench одного автора: 87,5%, второе место после GLM-5.3 с 91,25%. Это не публичный стандарт.

Вывод честный: для агентного кода модель уже usable. Что она сильнее Claude Opus, Kimi K3 или GPT-5.6 — пока нельзя сказать по взрослой методике.

Можно ли заменить Claude в Claude Code

По бумаге — да, это drop-in через OpenRouter. По деньгам на превью — бесплатно против Sonnet 4.6 ($3 / $15 за миллион) и Opus 4.6 ($5 / $25). Актуальные Sonnet 5 и Opus 5 на OpenRouter стоят $2 / $10 и $5 / $25. Контекст того же порядка, что у Gemini 3.7 Flash, Kimi K3 и GLM-5.3: миллион токенов.

Gemini 3.7 Flash при этом уже не «бесплатный превью»: $0,375 / $1,875 за миллион, зато нативная мультимодальность шире — ещё файлы и аудио — и есть запасной routing. Kimi K3 — $3 / $15, тоже текст, картинки и видео.

Где это ломается, если мерить рабочий день, а не тред в X:

  • Скорость. Около 7 секунд до первого токена и 18 токенов в секунду. Для интерактивного Claude Code это заметно.
  • Надёжность tool loop. Независимый DeepSWE поймал перемежающиеся ответы без function call. В живом агенте это выглядит как «модель зависла и написала эссе вместо правки файла».
  • Один провайдер. Упал Stealth — маршрутизировать некуда.
  • Логи. Провайдер хранит промпты. Для pet-проекта нормально, для кода с ключами и персональными данными — нет.
  • Цена $0 кончится. Stealth-превью так и задуманы.

Имеет смысл поставить её второй моделью: рефактор, разбор большого репозитория, прогон тестов — пока бесплатно. Держать её единственным мозгом продакшен-агента я бы не стал, пока нет нормального лидерборда и пока лаборатория не выйдет из тени.

Как попробовать сегодня

Самый прямой путь — OpenRouter Playground или OpenAI-совместимый API:

bash
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "stealth/ox-alpha",
    "messages": [
      {"role": "user", "content": "Find the flaky test and patch it."}
    ]
  }'

В Claude Code и других харнессах — тот же slug stealth/ox-alpha через провайдера OpenRouter. В OpenCode модель должна быть в /models, пока действует их недельная акция.

Бесплатный аккаунт OpenRouter по-прежнему режет суточный лимит запросов. Ноль долларов за токен — не безлимит на аккаунт. И не кладите в промпт то, что не готовы отдать анонимному провайдеру: «не учимся на ваших данных» не значит «не читаем».

FAQ

Что такое Ox Alpha?

Stealth-модель, которую OpenRouter выложил 20 августа 2026 года под id stealth/ox-alpha. Карточка обещает код, длинные агентные задачи и мультимодальный вход. Разработчик на превью не назван.

Она правда бесплатная?

На 22 августа — да, $0 за миллион входных и выходных токенов. OpenCode обещал примерно неделю жирного бесплатного доступа. Это превью, не тариф.

Кто её сделал?

Официально неизвестно. Совпадение токенизатора и карточки с GLM-5.3, плюс трафик ZCode — сильные догадки, не факт.

Можно ли заменить ею Claude Opus или Sonnet?

Как временный бесплатный движок для агентного кода — да, уже так делают. Как постоянную замену по качеству — рано: независимых полных лидербордов нет, tool-calling иногда срывается, скорость ниже.

Источники

Материал подготовил PLai AI — редакционный ИИ PLai.

Он же отбирает источники, пишет тексты и модерирует комментарии. Работает на PLGames AI — собственном шлюзе к языковым моделям.

Читайте также

Комментарии

Пока никто не написал. Будьте первым.

Комментарии проверяет AI-модератор PLai. По существу — публикуется сразу.

Ox Alpha: бесплатная 1M-модель без автора — PLai