Игорь Градов
Игорь Градов
6 мин
ai

ГЛМ 5.3 Флеш вышла анонимно и за неделю обогнала DeepSeek на 44 трлн токенов

Китайская лаборатория Z.ai 20 августа выложила на маршрутизатор OpenRouter модель под кодовым именем «ox-alpha» без указания автора, нулевой ценой и контекстным окном в миллион токенов, а через шесть дней призналась, что за анонимом скрывалась GLM 5.3 Flash.

ГЛМ 5.3 Флеш вышла анонимно и за неделю обогнала DeepSeek на 44 трлн токенов
Почему это важно

Это пятый подряд стелс-релиз китайской модели через OpenRouter под кодовым именем, и схема превращается в устойчивый канал промышленного тестирования на живом трафике до официального анонса.

Площадка OpenRouter (маршрутизатор, который перенаправляет запросы к разным языковым моделям через единый интерфейс) 20 августа получила строчку «stealth/ox-alpha» с пометкой «Anonymous» в поле провайдера. Ни карточки модели, ни документации. OpenRouter предупредил: площадка не владеет моделью, а только маршрутизирует запросы. Шесть дней спустя Z.ai (Zhipu) подтвердила Bloomberg, что «ox-alpha» и есть GLM 5.3 Flash, новая итерация серии GLM, и в тот же вечер опубликовала веса на HuggingFace.

Зачем модель выпускают без имени?

Схема стелс-релиза у Z.ai отработана. До «ox-alpha» точно так же анонимно выходили:

  • Pony Alpha, оказавшаяся GLM-5 от той же Zhipu
  • Hunter Alpha, MiMo-V2-Pro от Xiaomi
  • Elephant Alpha, Lingxi Ling-2.6-flash от Ant Group
  • Owl Alpha, LongCat-2.0 от Meituan

Во всех четырёх случаях за псевдонимом стояла китайская лаборатория. Логика прозрачна: компания выкладывает необъявленный чекпойнт (промежуточную версию обученной модели) под кодовым именем, ставит нулевую цену и наблюдает поведение на реальном трафике вместо лабораторных бенчмарков. Бесплатная промышленная оценка плюс вирусный эффект, если модель окажется сильной.

Что произошло за шесть дней?

Агентная среда OpenCode объявила, что «ox-alpha» будет бесплатной ровно неделю с почти неограниченным использованием. По заявлению провайдера, мощности рассчитаны на 100 триллионов токенов (токен, минимальная единица текста, которую обрабатывает модель, примерно три четверти слова) в день.

К моменту раскрытия панель OpenCode фиксировала:

  • 503 тысячи уникальных пользователей
  • 13,12 миллиона завершённых сессий
  • порядка 44 триллионов обработанных токенов (по данным OpenCode, цифра варьируется от 26 до 62 триллионов в зависимости от даты снятия среза)

В недельном рейтинге OpenRouter модель «ox-alpha» заняла первое место с более чем 23 триллионами токенов. Это вдвое больше, чем у ближайшего преследователя, DeepSeek V4 Flash. За первые три дня на самом OpenRouter модель обработала свыше 11 триллионов токенов, что стало крупнейшим запуском в истории площадки.

Ранний прогон оборвал 56-дневную серию DeepSeek на вершине лидерборда OpenCode. То есть «безымянная» модель сместила фаворита рынка, ещё не имея ни имени, ни документации.

Как вычислили GLM 5.3 Flash за анонимом?

Один из пользователей Reddit опубликовал результаты трёх тестов «чёрного ящика», сравнивающих «ox-alpha» с публичной GLM-5.3 на сайте z.ai:

  1. Тест токенизатора. При отправке шести текстов на разных языках (английский, немецкий, китайский, код, эмодзи) количество токенов у «ox-alpha» оказалось ровно на 75 больше, чем у GLM-5.3. Смещение абсолютно стабильное на каждом тексте, что указывает на скрытый системный промпт (системный промпт, предустановленная инструкция, которую модель получает до вашего запроса) поверх идентичного токенизатора. Другие модели, Kimi, Qwen, MiMo и MiniMax, давали совершенно другие цифры.

  2. Тест кода ошибки. При передаче некорректного параметра reasoning_effort обе модели возвращали одинаковую строку ошибки под кодом 1210.

  3. Тест детерминированного вывода. На температуре 0 (когда модель выдаёт один и тот же ответ каждый раз) обе модели форматировали текст идентично, включая специфичное немецкое написание десятичных дробей в LaTeX.

Разработчик Бен Дэвис заявил, что уверен на 99 процентов: модель принадлежит Zhipu. Он сослался на совпадающий видеоэнкодер, токенизатор, стиль ответов и поведение при джейлбрейке. Отдельная экспертиза 22 августа подтвердила: трассировка стека, код ошибки 1214 и совпадение токенизатора в 30 из 30 тестовых проб. Позже модель совпала с опубликованным словарём GLM-5 на всех 95 пробах.

Утёкший системный промпт предписывал модели представляться исключительно как «модель ox-alpha, разработанная нераскрытой организацией». Но токенизатор не подделаешь.

Что внутри GLM 5.3 Flash?

26 августа Z.ai подтвердила Bloomberg принадлежность модели и выложила веса. По данным компании, GLM 5.3 Flash:

  • Нативно мультимодальная (мультимодальная, то есть работает и с текстом, и с изображениями, и с видео) модель на 320 миллиардов параметров, из которых 18 миллиардов активных
  • Окно контекста в миллион токенов
  • Лицензия MIT (открытая модель, можно использовать коммерчески)
Как это применяли на практике

Пользователь AbdoKerdawy дал «ox-alpha» полный доступ к своему компьютеру и спецификацию SaaS-продукта. Спустя 4,5 часа модель купила домен, настроила Vercel, прошла верификацию Polar, подключила DNS, подцепила базу данных Supabase и задеплоила весь стек. 41 из 41 теста прошёл. Продукт включал ежедневные раунды, платный рейтинг, реферальную систему, крон-джобы (запланированные автоматические задачи) и платежи.

Другой пользователь, superalesha, показал полную сессию генерации 3D-сцены с океаном: 2625 записей, 951 ход, 820 вызовов инструментов за одну непрерывную сессию длиной 10,8 часа. Модель рендерила кадр, делала скриншот, считывала картинку обратно, решала, что брызги выглядят плохо, переписывала шейдер и рендерила заново, и так почти половину суток.

Что делать с этим прямо сейчас, по ролям?

Автору Дзена. Глм 5.3 флеш доступна бесплатно через OpenRouter. Можно использовать для генерации черновиков, переработки длинных текстов и работы с большим контекстом. Миллион токенов контекста позволяет загрузить в модель целую книгу и задавать вопросы по ней.

Маркетологу. Стелс-релизы через OpenRouter становятся каналом раннего доступа к сильным моделям до официального анонса. Подписка на обновления OpenRouter даёт фору: вы тестируете инструмент на неделю раньше конкурентов.

Предпринимателю в РФ и СНГ. OpenRouter доступен из России. GLM 5.3 Flash выпущена под лицензией MIT, то есть веса можно скачать с HuggingFace и развернуть на своём сервере без юридических ограничений. Из российских аналогов по размеру контекстного окна ближе всего YandexGPT, но миллиона токенов контекста ни одна отечественная модель пока не предлагает.

Частые ошибки

Не давайте незнакомой модели полный доступ к рабочей машине с реальными данными, как в примере с SaaS. Примеры из источника, это демонстрации энтузиастов, а не инструкция по безопасности. Модель может выполнить необратимые действия: купить домен, удалить файлы, изменить DNS.

Не путайте 320 миллиардов параметров с реальной нагрузкой: активных параметров 18 миллиардов, остальные «спят». Для локального запуска нужен соответствующий GPU, но требования ниже, чем кажется по полному размеру.

Стелс-релизы на OpenRouter бывают нестабильны: модель может исчезнуть, измениться или стать платной без предупреждения.

Мнение редакции dzen.guru

Схема со стелс-релизами по-своему красива: китайские лаборатории получают промышленное тестирование на полумиллионе живых пользователей, не тратя ни юаня на маркетинг. По моим наблюдениям, глм 5.3 флеш показывает себя сильно на длинных задачах с кодом, но для коротких текстовых запросов на русском языке пока уступает моделям, которые целенаправленно обучались на русскоязычных данных.

Честная оговорка: мы видели цифры от 26 до 62 триллионов токенов в разных срезах, точные данные о нагрузке пока не верифицированы независимо. Впечатляющие кейсы с постройкой SaaS за 4,5 часа, это лучшие примеры, а не гарантированный результат для каждого запроса.

Пять анонимных запусков подряд через один и тот же маршрутизатор, это уже не случайность, а канал дистрибуции. Если вы работаете с ИИ-инструментами, стоит добавить ленту обновлений OpenRouter в закладки: следующая «безымянная» модель, скорее всего, появится там раньше, чем в любом пресс-релизе.

Попробуйте ИИ-инструменты для авторов

Разбираем нейросети, которые реально работают для контента на Дзене

Перейти на dzen.guru
Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Барретт Зоф вернулся в Google вице-президентом: экспертиза RL теперь работает на Gemini
ai

Барретт Зоф вернулся в Google вице-президентом: экспертиза RL теперь работает на Gemini

Барретт Зоф, сооснователь ИИ-стартапа Thinking Machines и бывший руководитель в OpenAI, в июне 2025 года занял пост вице-президента по исследованиям в Google,…

4 мин
Одна строка в начале промпта обнуляет кеш Claude API: как найти утечку
ai

Одна строка в начале промпта обнуляет кеш Claude API: как найти утечку

Компания Anthropic, в отличие от DeepSeek и OpenAI, требует явно включать кеширование в запросах к Claude API, и даже когда кеш включён, одна динамическая…

7 мин
Окупаемость искусственного интеллекта остаётся в презентациях: три модели, которые это меняют
ai

Окупаемость искусственного интеллекта остаётся в презентациях: три модели, которые это меняют

Компания Anthropic опубликовала стратегию монетизации API, а разработчик и автор Игорь Градов в июне 2025 года разобрал три модели внедрения ИИ в бизнес и…

6 мин