hubris

Z.ai: GLM 5.3 Flash (batch)

z-ai/glm-5.3-flash:batch
z-ai
Выпущена 26 августа 2026 г.|1.0М контекст|18,95 ₽/М вход|63,18 ₽/М выход

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и выполнения агентских задач с длительным горизонтом. Её гибридная архитектура с разреженным и линейным вниманием поддерживает точное поведение в длинном контексте, снижая при этом вычислительные затраты.

Провайдер для Z.ai: GLM 5.3 Flash (batch)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

z-ai
Контекст
1.0М
токенов
Макс. ответ
944К
токенов
Вход
18,95 ₽
за 1М токенов
Выход
63,18 ₽
за 1М токенов
Кеш чтение
3,79 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Together
18,95 ₽63,18 ₽3,79 ₽

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от z-ai

Z.ai: GLM 5.3 Flash

Ограниченная по времени скидка 50% через ZAI до 9 сентября 2026 года в 16:00 UTC.

1.3М контекст·от 9,48 ₽/М

Z.ai: GLM Flash Latest

Эта модель всегда перенаправляется на последнюю модель в семействе GLM Flash.

1.3М контекст·от 9,48 ₽/М

Z.ai: GLM Latest

Эта модель всегда перенаправляется на последнюю модель GLM от Z.ai.

1.3М контекст·от 145,31 ₽/М

Z.ai: GLM 5.3

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.

1.3М контекст·от 176,91 ₽/М

Z.ai: GLM 5.2

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.

1.0М контекст·от 122,06 ₽/М

Z.ai: GLM 5.2 (free)

GLM 5.2 — это крупномасштабная модель рассуждений от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных рабочих процессов агентов, программной инженерии на уровне проектов и сложной многошаговой автоматизации. Поддерживаются уровни рассуждений high и xhigh; xhigh соответствует максимальному уровню рассуждений. Модель особенно сильна в кодировании и использовании инструментов в рамках длительных задач, способна поддерживать инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки, от требований до многоплатформенного развертывания, в рамках одной задачи.

256К контекст·бесплатно