hubris

Z.ai: GLM 5.1

z-ai/glm-5.1
z-ai
Выпущена 7 апреля 2026 г.|205К контекст|122,06 ₽/М вход|383,63 ₽/М выход

GLM-5.1 обеспечивает значительный скачок в возможностях кодирования, с особенно заметными улучшениями в решении долгосрочных задач. В отличие от предыдущих моделей, построенных на взаимодействиях минутного уровня, GLM-5.1 может работать независимо и непрерывно над одной задачей более 8 часов, автономно планируя, выполняя и совершенствуя себя на протяжении всего процесса, в конечном итоге предоставляя полные результаты инженерного уровня.

Провайдер для Z.ai: GLM 5.1

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

z-ai
Контекст
205К
токенов
Макс. ответ
128К
токенов
Вход
122,06 ₽
за 1М токенов
Выход
383,63 ₽
за 1М токенов
Кеш чтение
22,67 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

GMICloud35 %
176,91 ₽114,99 ₽555,98 ₽361,39 ₽32,85 ₽21,35 ₽99,5 %
Baidu32 %
176,91 ₽120,30 ₽555,99 ₽378,07 ₽32,85 ₽22,34 ₽100,0 %
StreamLake31 %
176,90 ₽122,06 ₽555,99 ₽383,63 ₽32,86 ₽22,67 ₽98,0 %
DigitalOcean
123,20 ₽543,35 ₽32,85 ₽91,8 %
Chutes
123,83 ₽389,19 ₽12,38 ₽85,6 %
DeepInfra
132,68 ₽442,26 ₽25,90 ₽97,6 %
SiliconFlow
150,37 ₽472,59 ₽75,82 ₽99,9 %
Crusoe
151,63 ₽555,99 ₽31,59 ₽99,7 %
Phala
152,90 ₽530,72 ₽75,82 ₽85,1 %
AtlasCloud
159,21 ₽500,39 ₽29,57 ₽99,6 %
Alibaba
168,06 ₽528,19 ₽31,21 ₽99,9 %
Novita
174,38 ₽555,99 ₽32,85 ₽99,9 %
Nebius
176,91 ₽555,99 ₽94,8 %
Parasail
176,91 ₽555,99 ₽32,85 ₽99,4 %
Friendli
176,91 ₽555,99 ₽32,85 ₽100,0 %
Z.AI
176,91 ₽555,99 ₽32,85 ₽98,8 %
Venice
194,60 ₽611,59 ₽36,14 ₽88,7 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от z-ai

Z.ai: GLM 5.3

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.

1.0М контекст·от 176,91 ₽/М

Z.ai: GLM 5.2 (free)

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.

256К контекст·бесплатно

Z.ai: GLM 5.2 (batch)

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.

512К контекст·от 176,91 ₽/М

Z.ai: GLM 5.2

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.

1.0М контекст·от 122,06 ₽/М

Z.ai: GLM 5V Turbo

GLM-5V-Turbo — это первая нативная мультимодальная базовая модель агента от Z.ai, созданная для визуального кодирования и задач, управляемых агентами. Она нативно обрабатывает изображения, видео и текстовые входные данные, превосходно справляется с долгосрочным планированием, сложным кодированием и выполнением задач, а также беспрепятственно работает с агентами для завершения полного цикла «воспринимать → планировать → выполнять».

203К контекст·от 151,63 ₽/М

Z.ai: GLM 5 Turbo

GLM-5 Turbo — это новая модель от Z.ai, разработанная для быстрого вывода и высокой производительности в агент-ориентированных средах, таких как сценарии OpenClaw. Она глубоко оптимизирована для реальных рабочих процессов агентов, включающих длинные цепочки выполнения, с улучшенным разложением сложных инструкций, использованием инструментов, запланированным и постоянным выполнением, а также общей стабильностью при выполнении длительных задач.

203К контекст·от 151,63 ₽/М