GLM-5 — это флагманская открытая базовая модель Z.ai, разработанная для проектирования сложных систем и долгосрочных рабочих процессов агентов. Созданная для опытных разработчиков, она обеспечивает производительность производственного уровня в крупномасштабных задачах программирования, конкурируя с ведущими закрытыми моделями. Благодаря усовершенствованному агентному планированию, глубокому бэкенд-анализу и итеративной самокоррекции, GLM-5 выходит за рамки генерации кода к полномасштабному построению систем и автономному выполнению.
Провайдер для Z.ai: GLM 5
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
StreamLake−40 % | — | 99,6 % | |||
GMICloud−40 % | — | 98,4 % | |||
Baidu | 88,37 ₽ | 282,77 ₽ | 17,67 ₽ | — | 99,8 % |
SiliconFlow | 119,92 ₽ | 321,90 ₽ | 25,25 ₽ | — | 99,6 % |
Amazon Bedrock | 126,24 ₽ | 403,96 ₽ | — | — | 91,5 % |
Venice | 126,24 ₽ | 403,96 ₽ | 25,25 ₽ | — | 97,8 % |
Novita | 126,24 ₽ | 403,96 ₽ | 25,25 ₽ | — | 100,0 % |
Z.AI | 126,24 ₽ | 403,96 ₽ | 25,25 ₽ | — | 99,8 % |
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от z-ai
Z.ai: GLM 5.3 Flash
Ограниченная по времени скидка 50% через ZAI до 9 сентября 2026 года в 16:00 UTC.
Z.ai: GLM Flash Latest
Эта модель всегда перенаправляется на последнюю модель в семействе GLM Flash.
Z.ai: GLM 5.3 Flash (batch)
GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и выполнения агентских задач с длительным горизонтом. Её гибридная архитектура с разреженным и линейным вниманием поддерживает точное поведение в длинном контексте, снижая при этом вычислительные затраты.
Z.ai: GLM Latest
Эта модель всегда перенаправляется на последнюю модель GLM от Z.ai.
Z.ai: GLM 5.3
GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.
Z.ai: GLM 5.3 (batch)
GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.