GLM-5.1 обеспечивает значительный скачок в возможностях кодирования, с особенно заметными улучшениями в решении долгосрочных задач. В отличие от предыдущих моделей, построенных на взаимодействиях минутного уровня, GLM-5.1 может работать независимо и непрерывно над одной задачей более 8 часов, автономно планируя, выполняя и совершенствуя себя на протяжении всего процесса, в конечном итоге предоставляя полные результаты инженерного уровня.
Провайдер для Z.ai: GLM 5.1
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
GMICloud−35 % | — | 99,5 % | |||
Baidu−32 % | — | 100,0 % | |||
StreamLake−31 % | — | 98,0 % | |||
DigitalOcean | 123,20 ₽ | 543,35 ₽ | 32,85 ₽ | — | 91,8 % |
Chutes | 123,83 ₽ | 389,19 ₽ | 12,38 ₽ | — | 85,6 % |
DeepInfra | 132,68 ₽ | 442,26 ₽ | 25,90 ₽ | — | 97,6 % |
SiliconFlow | 150,37 ₽ | 472,59 ₽ | 75,82 ₽ | — | 99,9 % |
Crusoe | 151,63 ₽ | 555,99 ₽ | 31,59 ₽ | — | 99,7 % |
Phala | 152,90 ₽ | 530,72 ₽ | 75,82 ₽ | — | 85,1 % |
AtlasCloud | 159,21 ₽ | 500,39 ₽ | 29,57 ₽ | — | 99,6 % |
Alibaba | 168,06 ₽ | 528,19 ₽ | 31,21 ₽ | — | 99,9 % |
Novita | 174,38 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,9 % |
Nebius | 176,91 ₽ | 555,99 ₽ | — | — | 94,8 % |
Parasail | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,4 % |
Friendli | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 100,0 % |
Z.AI | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 98,8 % |
Venice | 194,60 ₽ | 611,59 ₽ | 36,14 ₽ | — | 88,7 % |
Поддерживаемые параметры
Другие модели от z-ai
Z.ai: GLM 5.3
GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.
Z.ai: GLM 5.2 (free)
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.2 (batch)
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.2
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5V Turbo
GLM-5V-Turbo — это первая нативная мультимодальная базовая модель агента от Z.ai, созданная для визуального кодирования и задач, управляемых агентами. Она нативно обрабатывает изображения, видео и текстовые входные данные, превосходно справляется с долгосрочным планированием, сложным кодированием и выполнением задач, а также беспрепятственно работает с агентами для завершения полного цикла «воспринимать → планировать → выполнять».
Z.ai: GLM 5 Turbo
GLM-5 Turbo — это новая модель от Z.ai, разработанная для быстрого вывода и высокой производительности в агент-ориентированных средах, таких как сценарии OpenClaw. Она глубоко оптимизирована для реальных рабочих процессов агентов, включающих длинные цепочки выполнения, с улучшенным разложением сложных инструкций, использованием инструментов, запланированным и постоянным выполнением, а также общей стабильностью при выполнении длительных задач.