В каталоге OpenRouter 23 сентября 2026 года появилась модель Z.ai: GLM 5.3 Prime. По описанию провайдера, это высокоскоростной вариант GLM-5.3: модель унаследовала возможности базовой версии, но за счёт ускорения инференса выдаёт в 1.5–2 раза больше токенов в единицу времени. Название и характеристики взяты из карточки модели на OpenRouter.
Цена: $2.8 за 1M входных токенов и $8.8 за 1M выходных. Окно контекста равно 1 миллиону токенов. Поддерживается вызов инструментов.
Что известно из карточки
Описание от провайдера делает акцент на пропускной способности: GLM-5.3-Prime это high-speed вариант, а не отдельная линейка с новыми возможностями. Карточка не содержит отдельных заявлений о качестве рассуждений, планировании или код-ревью.
Карточка модели в OpenRouter фиксирует цену, размер окна и наличие вызова инструментов. По этим данным можно оценить, вписывается ли модель в бюджет и уместится ли нужный материал в контексте, но нельзя делать выводы о её пригодности для конкретной роли в пайплайне.
Что проверить у себя
- Сравните цену выходных токенов с моделями, которые уже используете в роли скоростного воркера: $8.8 за 1M служит ориентиром для расчёта стоимости длинных генераций.
- Замерьте на своих задачах, есть ли реальный прирост пропускной способности в диапазоне 1.5–2×, или это заявление работает только на синтетике провайдера.
- Убедитесь, что вызов инструментов совместим с вашей обвязкой: провайдер пишет, что поддержка есть, но формат tool call стоит протестировать на боевых схемах.