GLM 5 TurboилиQwen3.8 Max
Max впереди в качестве с рассуждениями и в возможностях. Ниже — счёт по трём источникам: что заявили поставщики, что намерила независимая лаборатория и что мы видим на реальных запросах. Переключатель «что важнее» меняет счёт — проверьте свой расклад.
- Поставщик карточки моделей и правила кэша
- Лаборатория Artificial Analysis, одна методика на обе
- Hubris наши реальные запросы за 30 дней
Сводная оценка Лаборатория Hubris
Одно число на модель от 0 до 100: качество, скорость, цена, кэш и возможности, нормированные по всему каталогу. Засечки — остальные модели на той же шкале.
Max опережает Turbo на 22 % по сводной оценке при выбранных весах. Из чего складывается — в раундах ниже.
Счёт по раундам 32 : 35
Раунд 1 из 6
Качество с рассуждениями
Качество мы не измеряем — это цифры независимой лаборатории: девять тестов одной методикой на обе модели, рассуждения включены на максимум. Шкала от 0 до 100.
Индекс интеллекта Лаборатория
Artificial Analysis, индекс v4. Замеры: GLM-5-Turbo, Qwen3.8 Max.
Раунд 2 из 6
Качество без рассуждений
В чате, поддержке и массовых задачах думать некогда — рассуждения выключены. Здесь картина часто другая.
Индекс интеллекта Лаборатория
Та же методика, режим без рассуждений.
Лаборатория ещё не измерила GLM 5 Turbo в этом режиме — раунд в счёт не идёт.
Раунд 3 из 6
Скорость
Пауза до первого слова и скорость письма. Очки — по нашим данным, это то, что вы получите на практике.
Один и тот же запросHubris
Проигрываем ответ на измеренной скорости: пауза до первого слова, потом письмо. Длина ответа одинаковая, иначе модели несравнимы.
По GLM 5 Turbo пока мало запросов, чтобы мерить скорость.
По Qwen3.8 Max пока мало запросов, чтобы мерить скорость.
Раунд 4 из 6
Цена
В рублях, за миллион токенов. Списывается по факту — за то, что реально отправили и получили.
Прайс и реальный средний чек Hubris
Первые две колонки — ставки каталога. Третья — сколько в среднем стоит один запрос нашим пользователям к этой модели.
| Модель | Входные токеныто, что вы отправили | Ответ моделито, что она написала | Типичный запроссредний по нашим пользователям |
|---|---|---|---|
| GLM 5 Turbo | 152 | 505 | мало данных |
| Qwen3.8 Max | 253 | 758 | мало данных |
| Разница | в 1,7 разав пользу Turbo | в полтора разав пользу Turbo | — |
Раунд 5 из 6
Кэш
Если начало промпта повторяется от запроса к запросу — системная инструкция, приложенный документ, история переписки, — эта часть считается со скидкой. Включается она у моделей по-разному, и на этом легко потерять деньги.
Правила кэширования Поставщик
Скидка применяется автоматически — Hubris списывает по фактической цене исполнения, в которой кэш уже учтён.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 80 % применится сама.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 88 % применится сама.
cached_tokens.Раунд 6 из 6
Возможности
Контекст, что принимает на вход, рассуждения, приватность, надёжность. За каждый пункт — очки по одной шкале.
- ✓Контекст 203 тыс. токенов
- —Картинки не принимает
- —Файлы не принимает
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Контекст 1 млн токенов
- ✓Принимает картинки
- —Файлы не принимает
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
Итог
Кто победил
Коротко
Плюсы и минусы
Преимущества каждой модели над другой — из тех же данных, что и раунды, в процентах и секундах.
- дешевле в 1,7 раза на входе
- качество с рассуждениями выше на 33 %
- принимает картинки
- контекст больше на 80 %
Выбор
Когда какую брать
Обе доступны по одному ключу — переключиться можно на любом запросе, поменяв одну строку.
- Массовые задачи, где счёт за токены — главная статья расходов
- Сложные задачи, где модели дают подумать: код, анализ, агенты
Вопросы
Что обычно спрашивают
Почему Turbo дешевле в 1,7 раза — он хуже?
По независимому индексу с рассуждениями — 39.1 против 58.1; второй режим лаборатория для одной из моделей ещё не измерила. Цена отражает размер модели и объём вычислений на ответ; проверьте на своих данных, заметна ли разница именно в вашей задаче.
Какая модель лучше для написания кода?
По независимому индексу с рассуждениями — 39.1 против 58.1. На практике для больших проектов берут ту, что лучше держит длинный контекст задачи; Max здесь предпочтительнее, а для мелких правок и массовых операций важнее скорость и цена.
Что такое кэш промптов и почему это важно?
У обеих кэш включается сам: если начало промпта совпадает с недавним запросом, эта часть считается со скидкой. Ничего помечать не нужно.
Откуда взяты цифры скорости?
Это наши измерения по успешным запросам через Hubris за последние 30 дней, а не заявления поставщиков: время до первого слова и скорость письма от начала до конца ответа. В паузу входит и наш участок пути. Лабораторная дорожка рядом — Artificial Analysis, прямой API одним промптом: это потолок, наша цифра — то, на что стоит рассчитывать.
Можно ли переключаться между моделями?
Да, обе доступны по одному ключу. Чтобы сменить модель, достаточно поменять её идентификатор в запросе — ни отдельного договора, ни второго ключа не нужно.
Дальше
Другие сравнения
Каждая из этих двух — против соседей по каталогу. Любую пару можно собрать в выборе наверху страницы.
Источники: GLM-5-Turbo и Qwen3.8 Max — Artificial Analysis, 2026-08-25; цены, контекст и модальности — каталог Hubris, 2026-08-25; скорость и средний чек — запросы через Hubris за 30 дней.