hubris

Z.ai: GLM 5

z-ai/glm-5
z-ai
Выпущена 11 февраля 2026 г.|205К контекст|75,74 ₽/М вход|242,37 ₽/М выход

GLM-5 — это флагманская открытая базовая модель Z.ai, разработанная для проектирования сложных систем и долгосрочных рабочих процессов агентов. Созданная для опытных разработчиков, она обеспечивает производительность производственного уровня в крупномасштабных задачах программирования, конкурируя с ведущими закрытыми моделями. Благодаря усовершенствованному агентному планированию, глубокому бэкенд-анализу и итеративной самокоррекции, GLM-5 выходит за рамки генерации кода к полномасштабному построению систем и автономному выполнению.

Провайдер для Z.ai: GLM 5

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

z-ai
Контекст
205К
токенов
Макс. ответ
128К
токенов
Вход
75,74 ₽
за 1М токенов
Выход
242,37 ₽
за 1М токенов
Кеш чтение
15,15 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

StreamLake40 %
126,23 ₽75,74 ₽403,95 ₽242,37 ₽25,25 ₽15,15 ₽99,6 %
GMICloud40 %
126,23 ₽75,74 ₽403,95 ₽242,37 ₽25,25 ₽15,15 ₽98,4 %
Baidu
88,37 ₽282,77 ₽17,67 ₽99,8 %
SiliconFlow
119,92 ₽321,90 ₽25,25 ₽99,6 %
Amazon Bedrock
126,24 ₽403,96 ₽91,5 %
Venice
126,24 ₽403,96 ₽25,25 ₽97,8 %
Novita
126,24 ₽403,96 ₽25,25 ₽100,0 %
Z.AI
126,24 ₽403,96 ₽25,25 ₽99,8 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от z-ai

Z.ai: GLM 5.3 Flash

Ограниченная по времени скидка 50% через ZAI до 9 сентября 2026 года в 16:00 UTC.

1.3М контекст·от 11,36 ₽/М

Z.ai: GLM Flash Latest

Эта модель всегда перенаправляется на последнюю модель в семействе GLM Flash.

1.3М контекст·от 9,47 ₽/М

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и выполнения агентских задач с длительным горизонтом. Её гибридная архитектура с разреженным и линейным вниманием поддерживает точное поведение в длинном контексте, снижая при этом вычислительные затраты.

1.0М контекст·от 9,47 ₽/М

Z.ai: GLM Latest

Эта модель всегда перенаправляется на последнюю модель GLM от Z.ai.

1.3М контекст·от 110,77 ₽/М

Z.ai: GLM 5.3

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.

1.3М контекст·от 176,73 ₽/М

Z.ai: GLM 5.3 (batch)

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.

1.0М контекст·от 88,37 ₽/М