GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.
Провайдер для Z.ai: GLM 5.3
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Reka | 145,31 ₽ | 442,26 ₽ | 12,64 ₽ | — | 90,3 % | < 0,1 % |
AkashML−10 % | — | 99,1 % | < 0,1 % | |||
Decart−15 % | — | 97,8 % | < 0,1 % | |||
Wafer | 150,37 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,1 % | < 0,1 % |
DeepInfra | 151,63 ₽ | 505,44 ₽ | 15,16 ₽ | — | 98,2 % | < 0,1 % |
Inceptron | 157,95 ₽ | 555,99 ₽ | 32,85 ₽ | — | 98,6 % | < 0,1 % |
Morph | 157,95 ₽ | 555,99 ₽ | 32,85 ₽ | — | 95,8 % | < 0,1 % |
Io Net | 157,95 ₽ | 555,99 ₽ | 32,85 ₽ | 12 т/с | 99,7 % | 1,1 % |
Friendli−10 % | 122 т/с | 100,0 % | 2,0 % | |||
Makora | 170,59 ₽ | 555,99 ₽ | 29,06 ₽ | — | 98,0 % | < 0,1 % |
Sail Research | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,9 % | < 0,1 % |
SiliconFlow | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,7 % | < 0,1 % |
Phala | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,5 % | < 0,1 % |
Novita | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 100,0 % | < 0,1 % |
Together | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | 95 т/с | 97,4 % | 2,4 % |
DigitalOcean | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 98,0 % | < 0,1 % |
Parasail | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | 18 т/с | 99,6 % | 2,7 % |
Modal | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | 156 т/с | 100,0 % | 12,3 % |
GMICloud | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,8 % | < 0,1 % |
BaseTen | 176,91 ₽ | 555,99 ₽ | 17,69 ₽ | 123 т/с | 99,9 % | 10,1 % |
Fireworks | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,8 % | < 0,1 % |
Cloudflare | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | 71 т/с | 99,9 % | 1,2 % |
AtlasCloud | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | — | 99,7 % | < 0,1 % |
Z.AI | 176,91 ₽ | 555,99 ₽ | 32,85 ₽ | 54 т/с | 100,0 % | 68,2 % |
Venice | 221,13 ₽ | 694,98 ₽ | 41,07 ₽ | — | 88,1 % | < 0,1 % |
BaseTen | 265,36 ₽ | 833,98 ₽ | 26,54 ₽ | 123 т/с | 100,0 % | 10,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от z-ai
Z.ai: GLM 5.3 Flash
Ограниченная по времени скидка 50% через ZAI до 9 сентября 2026 года в 16:00 UTC.
Z.ai: GLM Flash Latest
Эта модель всегда перенаправляется на последнюю модель в семействе GLM Flash.
Z.ai: GLM 5.3 Flash (batch)
GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и выполнения агентских задач с длительным горизонтом. Её гибридная архитектура с разреженным и линейным вниманием поддерживает точное поведение в длинном контексте, снижая при этом вычислительные затраты.
Z.ai: GLM Latest
Эта модель всегда перенаправляется на последнюю модель GLM от Z.ai.
Z.ai: GLM 5.2 (free)
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.
Z.ai: GLM 5.2
GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.