hubris

Z.ai: GLM 5V Turbo

z-ai/glm-5v-turbo
z-ai
Выпущена 1 апреля 2026 г.|203К контекст|151,48 ₽/М вход|504,95 ₽/М выход

GLM-5V-Turbo — это первая нативная мультимодальная базовая модель агента от Z.ai, созданная для визуального кодирования и задач, управляемых агентами. Она нативно обрабатывает изображения, видео и текстовые входные данные, превосходно справляется с долгосрочным планированием, сложным кодированием и выполнением задач, а также беспрепятственно работает с агентами для завершения полного цикла «воспринимать → планировать → выполнять».

Провайдер для Z.ai: GLM 5V Turbo

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

z-ai
Контекст
203К
токенов
Макс. ответ
131К
токенов
Вход
151,48 ₽
за 1М токенов
Выход
504,95 ₽
за 1М токенов
Кеш чтение
30,30 ₽
за 1М токенов

Модальности

Вход:ИзображенияТекстВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Z.AI
151,48 ₽504,95 ₽30,30 ₽100,0 %

Поддерживаемые параметры

include_reasoningmax_tokensreasoningresponse_formattemperaturetool_choicetoolstop_ktop_p

Другие модели от z-ai

Z.ai: GLM 5.3 Flash

Ограниченная по времени скидка 50% через ZAI до 9 сентября 2026 года в 16:00 UTC.

1.3М контекст·от 18,94 ₽/М

Z.ai: GLM 5.3

GLM-5.3 — это крупномасштабная модель рассуждений от Z.ai, созданная для решения сложных задач программной инженерии и долгосрочных агентских задач. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании и в балансе между производительностью и эффективностью токенов. Рассуждения всегда включены и не могут быть отключены. Поддерживаются низкие, высокие и максимальные усилия рассуждений; по умолчанию установлено максимальное.

1.3М контекст·от 88,37 ₽/М

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX — это высокоскоростной вариант GLM-5.3-Flash от Z.ai, нативной мультимодальной модели, обеспечивающей скорость инференса до 200 токенов/с. Построенная на той же гибридной архитектуре разреженного и линейного attention (320B общих параметров, 18B активных), она подходит для эффективного кодирования, визуального понимания и задач агентов с длинным горизонтом с контекстным окном в 1M токенов.

1.0М контекст·от 46,71 ₽/М

Z.ai: GLM Flash Latest

Эта модель всегда перенаправляется на последнюю модель в семействе GLM Flash.

1.3М контекст·от 9,47 ₽/М

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и выполнения агентских задач с длительным горизонтом. Её гибридная архитектура с разреженным и линейным вниманием поддерживает точное поведение в длинном контексте, снижая при этом вычислительные затраты.

1.0М контекст·от 9,47 ₽/М

Z.ai: GLM Latest

Эта модель всегда перенаправляется на последнюю модель GLM от Z.ai.

1.3М контекст·от 88,37 ₽/М