~/wiki / novosti / ox-alpha-glm-5-3-flash

Ox Alpha оказался GLM-5.3-Flash: как стелс-модель Z.ai возглавила чарты OpenRouter

Основной чат

Чат для вайбкодеров: новости, гайды, поиск исполнителей, маркетплейс и разбор реальных кейсов.

$ cd раздел/ $ join vibe dev
Ox Alpha оказался GLM-5.3-Flash: как стелс-модель Z.ai возглавила чарты OpenRouter - обложка

Загадочная стелс-модель Ox Alpha, которая с 20 августа бесплатно раздавалась на OpenRouter и OpenCode и попутно вылезла в топ usage-чартов, оказалась GLM-5.3-Flash от Z.ai. 26 августа компания раскрыла авторство и выложила веса под MIT-лицензией на Hugging Face.

  • Что это: мультимодальная MoE-модель 320B параметров, 18B активных (320B-A18B).
  • Контекст: 1 048 576 токенов (1M), вход — текст, изображения и видео.
  • Зачем вам: сильный и очень дешёвый инструмент для кодинга и агентских задач, с открытыми весами.
  • Осторожно: бесплатный «стелс»-режим закончился, публичные цены и лимиты теперь другие.

Что произошло

20 августа 2026 года на OpenRouter появилась анонимная модель под именем stealth/ox-alpha. Ни лейбла, ни вендора, ни описания — только карточка с гигантским контекстом в 1M токенов, поддержкой картинок и видео на входе и ценой в $0 за токены и на вход, и на выход. Параллельно её же начали раздавать в OpenCode.

Дальше случилось то, что и должно случиться с мощной бесплатной моделью: за несколько дней Ox Alpha забралась в топ usage-чартов, местами опередив DeepSeek. Разработчики гоняли её на реальных задачах, сравнивали с Claude и GPT, гадали, кто стоит за релизом. К 25 августа о «таинственной модели» уже писал Bloomberg.

26 августа Z.ai закрыла интригу: Ox Alpha — это превью-прогон GLM-5.3-Flash, который тестировали анонимно, чтобы собрать честную обратную связь без эффекта бренда. Одновременно вышел именованный релиз, а бесплатные стелс-маршруты заменили на обычные — уже с публичными ценами и лимитами.

Зачем нужен был анонимный запуск

Приём с «безымянной» моделью — это не маркетинговый трюк ради хайпа, а способ снять с оценки искажение ожиданиями. Когда на карточке написано «GLM» или «OpenAI», часть суждения о качестве формируется заранее. Анонимный ox-alpha заставлял людей судить по результату: по тому, как модель реально чинит баги, держит длинный контекст и ведёт себя в агентском цикле.

Побочный эффект — честный стресс-тест инфраструктуры. Бесплатный доступ мгновенно нагоняет нагрузку, и вендор видит поведение модели под реальным трафиком, а не в лабораторных условиях. Для Z.ai это ещё и способ показать, что предыдущая история с GLM-5 была не разовым успехом.

Что известно про GLM-5.3-Flash

По данным Z.ai и первых разборов, ключевые характеристики выглядят так:

  • Архитектура: Mixture-of-Experts, 320B параметров, 18B активных на токен. Это «Flash»-линейка — ставка на скорость и стоимость, а не на максимальный «сырой» интеллект.
  • Мультимодальность: нативная, а не прикрученная сбоку. На вход принимаются текст, изображения и видео.
  • Контекст: 1 048 576 токенов. Этого хватает, чтобы держать в окне крупную кодовую базу или длинную сессию агента без агрессивной нарезки.
  • Лицензия: MIT, веса опубликованы на Hugging Face — можно запускать локально и использовать коммерчески.
  • Железо: по сообщениям (в частности, Quartz), модель обучена на китайских чипах, что продолжает линию GLM-5, тренированной на Huawei Ascend.
$ cd ../ ← назад к Новости

$ nav --prev

OpenAI открывает бесплатным пользователям ChatGPT безлимитные чаты с GPT-5.6 Luna

$ nav --next

OpenAI выпустила GPT-6 Astra — компанию называет это началом «эры AGI»