GLM-5 Turbo через API из России: подключение, цены и семейство моделей Z.AI
2 августа 2026 г. · Константин Романков · 5 мин чтения
GLM-5 Turbo — флагманская языковая модель китайской компании Z.AI. Через Hubris вы получаете к ней OpenAI-совместимый доступ и оплачиваете использование в рублях, без зарубежной карты и без прямого подключения к китайским серверам.
Что такое GLM-5 Turbo и семейство GLM
GLM (General Language Model) — серия языковых моделей, которую разрабатывает Z.AI (бывший Zhipu AI). Модели активно используются в Китае и набирают популярность среди разработчиков по всему миру как доступная альтернатива GPT и Claude.
GLM-5 Turbo — одна из самых мощных моделей серии: контекстное окно 202 752 токена, уверенная работа с кодом, рассуждениями и текстами на русском языке. Цена за 1 млн входных токенов — 135,55 ₽, выходных — 451,84 ₽.
Помимо Turbo, в каталоге доступны все основные варианты семейства:
| Модель | Контекст | Вход, ₽/млн | Выход, ₽/млн |
|---|---|---|---|
| GLM-5 Turbo | 202 752 | 135,55 | 451,84 |
| GLM-5.2 | 1 048 576 | 37,80 | 118,79 |
| GLM-5.1 | 204 800 | 109,12 | 342,94 |
| GLM-5 | 204 800 | 107,31 | 288,05 |
| GLM-4.7 | 204 800 | 45,18 | 197,68 |
| GLM-4.7 Flash | 202 752 | 6,78 | 45,18 |
| GLM-4.6 | 204 800 | 56,48 | 225,92 |
| GLM-4.5 Air | 131 072 | 14,68 | 96,02 |
GLM-5V Turbo и GLM-4.5V — мультимодальные варианты с поддержкой изображений на входе.
Как подключиться к GLM-5 Turbo из России
Прямой доступ к Z.AI API из России затруднён: китайские сервисы требуют местную банковскую карту или VPN, а оплата в юанях создаёт дополнительные сложности. Через Hubris весь этот путь сокращается до двух шагов.
Шаг 1. Зарегистрируйтесь и пополните баланс
- Зайдите на hubris.pw и создайте аккаунт.
- Пополните баланс от 300 ₽ — через СБП, банковскую карту или выставьте счёт (для юрлиц).
- В разделе «API-ключи» создайте новый ключ — скопируйте его сразу, он показывается один раз.
Шаг 2. Сделайте первый запрос
Hubris полностью совместим с OpenAI API, поэтому любой SDK или инструмент (Python openai, curl, LangChain) работает без изменений кода — достаточно поменять base URL и ключ:
from openai import OpenAI
client = OpenAI(
api_key="sk-gw-ваш_ключ",
base_url="https://api.hubris.pw/v1"
)
response = client.chat.completions.create(
model="z-ai/glm-5-turbo",
messages=[{"role": "user", "content": "Привет! Расскажи о себе кратко."}]
)
print(response.choices[0].message.content)
Для GLM-5.2 с контекстом 1 млн токенов — просто укажите model="z-ai/glm-5.2".
Какую модель семейства GLM выбрать
Выбор зависит от задачи и бюджета:
- GLM-5 Turbo — максимальное качество в серии, подходит для сложных рассуждений, кода и длинных диалогов.
- GLM-5.2 — самый доступный вариант с гигантским контекстом (1 048 576 токенов); удобен для анализа больших документов.
- GLM-4.7 Flash — экономичный режим: в 20× дешевле Turbo, подходит для высоконагруженных сценариев (классификация, краткие ответы).
- GLM-4.5 Air — баланс цены и качества для большинства задач.
- GLM-5V Turbo / GLM-4.5V — если нужно обрабатывать изображения вместе с текстом.
Полный список с актуальными ценами — на странице каталога.
Поддержка русского языка
GLM-5 Turbo уверенно работает с русскоязычными текстами: генерирует связные ответы, понимает технические запросы и корректно обрабатывает смешанный русско-английский контент (типичный для кода с комментариями). Для задач, где нужен максимально точный русский, рекомендуем сравнить с Claude или GPT-4o — все доступны через тот же API и ключ.
Использование в IDE и инструментах
GLM-5 Turbo работает во всех инструментах, которые поддерживают OpenAI-совместимый API. Например, в Continue, Roo Code, Cursor или любом другом AI-ассистенте достаточно задать:
- API Base URL:
https://api.hubris.pw/v1 - API Key: ваш ключ Hubris
- Model:
z-ai/glm-5-turbo
Подробная инструкция по настройке AI-ассистентов — в статье «Roo Code из России: настраиваем доступ и выбираем модели».
Частые вопросы
Чем GLM-5 Turbo отличается от GLM-5? GLM-5 Turbo — более новая и производительная версия, оптимизированная для скорости ответа. Качество рассуждений выше, но и цена чуть больше, чем у GLM-5.
Поддерживает ли GLM-5 Turbo стриминг?
Да, стриминг (Server-Sent Events) поддерживается полностью — передайте stream=True в запросе, и ответ будет приходить токен за токеном.
Как оплатить GLM API из России без иностранной карты? Пополните баланс Hubris через СБП или банковскую карту российского банка — от 300 ₽. Платёжные данные Z.AI вводить не нужно: Hubris выступает посредником и берёт на себя расчёты с поставщиком.
Есть ли бесплатный доступ к GLM? В каталоге Hubris есть бесплатные модели — но GLM-5 Turbo к ним не относится. Зато тарификация поминутная: платите только за реально потреблённые токены.
Можно ли использовать GLM-5V Turbo для анализа изображений?
Да, GLM-5V Turbo принимает изображения на вход. Передайте картинку в формате image_url в поле content, как это описано в документации OpenAI Vision.
Все модели из статьи доступны в Hubris — единый API, оплата в рублях.