GLM 5.2илиHy3
Главная разница — цена: Hy3 дешевле в девять раз на входе и в семь раз на выходе. Ниже — счёт по трём источникам: что заявили поставщики, что намерила независимая лаборатория и что мы видим на реальных запросах. Переключатель «что важнее» меняет счёт — проверьте свой расклад.
- Поставщик карточки моделей и правила кэша
- Лаборатория Artificial Analysis, одна методика на обе
- Hubris наши реальные запросы за 30 дней
Сводная оценка Лаборатория Hubris
Одно число на модель от 0 до 100: качество, скорость, цена, кэш и возможности, нормированные по всему каталогу. Засечки — остальные модели на той же шкале.
Hy3 опережает GLM на 8 % по сводной оценке при выбранных весах. Из чего складывается — в раундах ниже.
Счёт по раундам 37 : 41
Раунд 1 из 6
Качество с рассуждениями
Качество мы не измеряем — это цифры независимой лаборатории: девять тестов одной методикой на обе модели, рассуждения включены на максимум. Шкала от 0 до 100.
Индекс интеллекта Лаборатория
Artificial Analysis, индекс v4. Замеры: GLM-5.2 (Non-reasoning), Hy3-preview (Non-reasoning).
Раунд 2 из 6
Качество без рассуждений
В чате, поддержке и массовых задачах думать некогда — рассуждения выключены. Здесь картина часто другая.
Индекс интеллекта Лаборатория
Та же методика, режим без рассуждений.
Раунд 3 из 6
Скорость
Пауза до первого слова и скорость письма. Очки — по нашим данным, это то, что вы получите на практике.
Один и тот же запросHubrisЛаборатория
Проигрываем ответ на измеренной скорости: пауза до первого слова, потом письмо. Лабораторной дорожки у Hy3 нет — лаборатория скорость этой версии не публикует. Длина ответа одинаковая, иначе модели несравнимы.
По Hy3 пока мало запросов, чтобы мерить скорость.
Раунд 4 из 6
Цена
В рублях, за миллион токенов. Списывается по факту — за то, что реально отправили и получили.
Прайс и реальный средний чек Hubris
Первые две колонки — ставки каталога. Третья — сколько в среднем стоит один запрос нашим пользователям к этой модели.
| Модель | Входные токеныто, что вы отправили | Ответ моделито, что она написала | Типичный запроссредний по нашим пользователям |
|---|---|---|---|
| GLM 5.2 | 150 | 473 | 2,17 |
| Hy3 | 16,68 | 66,72 | мало данных |
| Разница | в девять разв пользу Hy3 | в семь разв пользу Hy3 | — |
Раунд 5 из 6
Кэш
Если начало промпта повторяется от запроса к запросу — системная инструкция, приложенный документ, история переписки, — эта часть считается со скидкой. Включается она у моделей по-разному, и на этом легко потерять деньги.
Правила кэширования Поставщик
Скидка применяется автоматически — Hubris списывает по фактической цене исполнения, в которой кэш уже учтён.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 81 % применится сама.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 75 % применится сама.
cached_tokens.Раунд 6 из 6
Возможности
Контекст, что принимает на вход, рассуждения, приватность, надёжность. За каждый пункт — очки по одной шкале.
- ✓Контекст 1,05 млн токенов
- —Картинки не принимает
- —Файлы не принимает
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Доля неудачных запросов 0,6 %
- ✓Контекст 262 тыс. токенов
- —Картинки не принимает
- —Файлы не принимает
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
Итог
Кто победил
Коротко
Плюсы и минусы
Преимущества каждой модели над другой — из тех же данных, что и раунды, в процентах и секундах.
- качество без рассуждений выше на 24 %
- качество с рассуждениями выше на 20 %
- контекст больше на 75 %
- дешевле в девять раз на входе
Выбор
Когда какую брать
Обе доступны по одному ключу — переключиться можно на любом запросе, поменяв одну строку.
- Точные ответы без времени на раздумья — поддержка, извлечение смысла
- Сложные задачи, где модели дают подумать: код, анализ, агенты
- Массовые задачи, где счёт за токены — главная статья расходов
Вопросы
Что обычно спрашивают
Почему Hy3 дешевле в девять раз — он хуже?
С включёнными рассуждениями разница по независимому индексу — 52.6 против 42.2; без рассуждений — 34.8 против 26.6. То есть GLM оправдывает цену там, где модели некогда думать. Самый дешёвый способ убедиться — прогнать оба варианта на своих данных.
Какая модель лучше для написания кода?
По независимому индексу с рассуждениями — 52.6 против 42.2. На практике для больших проектов берут ту, что лучше держит длинный контекст задачи; GLM здесь предпочтительнее, а для мелких правок и массовых операций важнее скорость и цена.
Что такое кэш промптов и почему это важно?
У обеих кэш включается сам: если начало промпта совпадает с недавним запросом, эта часть считается со скидкой. Ничего помечать не нужно.
Откуда взяты цифры скорости?
Это наши измерения по успешным запросам через Hubris за последние 30 дней, а не заявления поставщиков: время до первого слова и скорость письма от начала до конца ответа. В паузу входит и наш участок пути. Лабораторная дорожка рядом — Artificial Analysis, прямой API одним промптом: это потолок, наша цифра — то, на что стоит рассчитывать.
Можно ли переключаться между моделями?
Да, обе доступны по одному ключу. Чтобы сменить модель, достаточно поменять её идентификатор в запросе — ни отдельного договора, ни второго ключа не нужно.
Дальше
Другие сравнения
Каждая из этих двух — против соседей по каталогу. Любую пару можно собрать в выборе наверху страницы.
Источники: GLM-5.2 (Non-reasoning) и Hy3-preview (Non-reasoning) — Artificial Analysis, 2026-08-25; цены, контекст и модальности — каталог Hubris, 2026-08-25; скорость и средний чек — запросы через Hubris за 30 дней.