GLM-5 — это флагманская открытая базовая модель Z.ai, разработанная для проектирования сложных систем и долгосрочных рабочих процессов агентов. Созданная для опытных разработчиков, она обеспечивает производительность производственного уровня в крупномасштабных задачах программирования, конкурируя с ведущими закрытыми моделями. Благодаря усовершенствованному агентному планированию, глубокому бэкенд-анализу и итеративной самокоррекции, GLM-5 выходит за рамки генерации кода к полномасштабному построению систем и автономному выполнению.
Провайдер для Z.ai: GLM 5
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
StreamLake−40 % | 27 т/с | 99,9 % | 98,7 % | |||
GMICloud−40 % | — | 99,5 % | < 0,1 % | |||
DeepInfra | 75,82 ₽ | 262,83 ₽ | 15,16 ₽ | 23 т/с | 98,9 % | 0,5 % |
Baidu | 88,45 ₽ | 283,05 ₽ | 17,69 ₽ | 35 т/с | 99,9 % | 0,1 % |
DigitalOcean | 94,77 ₽ | 303,27 ₽ | 25,27 ₽ | — | 94,0 % | < 0,1 % |
SiliconFlow | 120,04 ₽ | 322,22 ₽ | 25,27 ₽ | 36 т/с | 99,7 % | 0,3 % |
AtlasCloud | 120,04 ₽ | 398,04 ₽ | 24,01 ₽ | — | 99,7 % | < 0,1 % |
Amazon Bedrock | 126,36 ₽ | 404,35 ₽ | — | — | 92,4 % | < 0,1 % |
Novita | 126,36 ₽ | 404,35 ₽ | 25,27 ₽ | — | 100,0 % | < 0,1 % |
Z.AI | 126,36 ₽ | 404,35 ₽ | 25,27 ₽ | — | 99,3 % | < 0,1 % |
Venice | 126,36 ₽ | 404,35 ₽ | 25,27 ₽ | 59 т/с | 93,7 % | 0,4 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Другие модели от z-ai
Z.ai: GLM 5.3
GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.
Z.ai: GLM 5.2 (free)
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.2 (batch)
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.2
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.1
GLM-5.1 обеспечивает значительный скачок в возможностях кодирования, с особенно заметными улучшениями в решении долгосрочных задач. В отличие от предыдущих моделей, построенных на взаимодействиях минутного уровня, GLM-5.1 может работать независимо и непрерывно над одной задачей более 8 часов, автономно планируя, выполняя и совершенствуя себя на протяжении всего процесса, в конечном итоге предоставляя полные результаты инженерного уровня.
Z.ai: GLM 5V Turbo
GLM-5V-Turbo — это первая нативная мультимодальная базовая модель агента от Z.ai, созданная для визуального кодирования и задач, управляемых агентами. Она нативно обрабатывает изображения, видео и текстовые входные данные, превосходно справляется с долгосрочным планированием, сложным кодированием и выполнением задач, а также беспрепятственно работает с агентами для завершения полного цикла «воспринимать → планировать → выполнять».