z-ai/glm-5.3-primeGLM-5.3-Prime — это высокоскоростной вариант модели GLM-5.3 от Z.ai, сохраняющий все её возможности и обеспечивающий в 1,5–2 раза большую пропускную способность вывода за счёт ускорения инференса. Модель поддерживает ввод и вывод текста с объёмом до 1 миллиона токенов.
Параметры, которые поддерживает эта модель в API-запросах
Сравните разных провайдеров на AllTokens
Система автоматически выбирает оптимального провайдера и переключается на резервный при сбоях.
Оценки модели из Artificial Analysis
curl https://api.alltokens.ru/api/v1/chat/completions \
-H "Authorization: Bearer $ALLTOKENS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "z-ai/glm-5.3-prime",
"messages": [
{"role": "user", "content": "Привет! Кратко объясни, что умеешь."}
]
}'Z.ai: GLM 5.3 Prime от провайдера z-ai доступна через OpenAI-совместимый API AllTokens.
Страница агрегирует практические параметры для интеграции: стоимость входа и выхода, рабочий контекст, набор поддерживаемых параметров и сигналы для выбора модели под конкретные продакшн-сценарии.
Контекст
1 000 000 токенов
Цена входа
322 ₽ / 1M токенов
Цена выхода
1 012 ₽ / 1M токенов
Входные модальности
Выходные модальности
Добавлена в каталог
23.09.2026
Z.ai: GLM 5.3 FlashX
z-ai
GLM-5.3-FlashX — это высокоскоростной вариант модели GLM-5.3-Flash от Z.ai, нативная мультимодальная модель, обеспечивающая скорость вывода до 200 токенов в секунду. Построена на той же гибридной архитектуре с разреженным и линейным вниманием.
Z.ai: GLM 5.3 Flash (batch)
z-ai
GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она предназначена для эффективного программирования и задач с длительным горизонтом планирования. Гибридная архитектура с разреженным и линейным вниманием обеспечивает точную работу с длинным контекстом, одновременно...
Z.ai: GLM 5.3 Flash
z-ai
GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она предназначена для эффективного программирования и задач с длительным горизонтом планирования. Гибридная архитектура с разреженным и линейным вниманием обеспечивает точное поведение при работе с длинным контекстом, одновременно...
Z.ai: GLM 5.3 (batch)
z-ai
GLM-5.3 — это масштабная модель рассуждений от Z.ai, разработанная для сложных задач в области программной инженерии и долгосрочного планирования агентов. Модель поддерживает ввод и вывод текста с контекстным окном размером 1 миллион токенов и обеспечивает улучшенную производительность в соответствующих задачах.
Z.ai: GLM 5.3
z-ai
GLM-5.3 — это масштабная модель рассуждений от Z.ai, разработанная для сложных задач в области программной инженерии и долгосрочного планирования агентов. Модель поддерживает ввод и вывод текста с контекстным окном размером 1 миллион токенов и обеспечивает улучшенную производительность в соответствующих задачах.
Z.ai: GLM 5.2 (Бесплатно)
z-ai
GLM 5.2 — это масштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и подходит для долгосрочных рабочих процессов агентов, проектной разработки программного обеспечения и других задач, требующих глубокого анализа и обработки больших объемов информации.
Подробный обзор модели
Новости, изменения цены, ключевые обновления и практические рекомендации по интеграции.
Открыть обзор
Модели для программирования
Выборка кодинг-моделей для разработки: инструменты, reasoning, качество генерации и скорость.
Смотреть подборку
Модели с длинным контекстом
Список моделей с большим context window для анализа длинных документов, репозиториев и агентных пайплайнов.
Смотреть подборку