DeepSeek V4 Flash 0731илиGrok 4.20
Главная разница — цена: DeepSeek 0731 дешевле в девять раз на входе и в девять раз на выходе. Ниже — счёт по трём источникам: что заявили поставщики, что намерила независимая лаборатория и что мы видим на реальных запросах. Переключатель «что важнее» меняет счёт — проверьте свой расклад.
- Поставщик карточки моделей и правила кэша
- Лаборатория Artificial Analysis, одна методика на обе
- Hubris наши реальные запросы за 30 дней
Сводная оценка Лаборатория Hubris
Одно число на модель от 0 до 100: качество, скорость, цена, кэш и возможности, нормированные по всему каталогу. Засечки — остальные модели на той же шкале.
DeepSeek 0731 опережает Grok на 6 % по сводной оценке при выбранных весах. Из чего складывается — в раундах ниже.
Счёт по раундам 54 : 45
Раунд 1 из 6
Качество с рассуждениями
Качество мы не измеряем — это цифры независимой лаборатории: девять тестов одной методикой на обе модели, рассуждения включены на максимум. Шкала от 0 до 100.
Индекс интеллекта Лаборатория
Artificial Analysis, индекс v4. Замеры: DeepSeek V4 Flash (Non-reasoning), Grok 4.20 0309 v2 (Non-reasoning).
Раунд 2 из 6
Качество без рассуждений
В чате, поддержке и массовых задачах думать некогда — рассуждения выключены. Здесь картина часто другая.
Индекс интеллекта Лаборатория
Та же методика, режим без рассуждений.
Раунд 3 из 6
Скорость
Пауза до первого слова и скорость письма. Очки — по нашим данным, это то, что вы получите на практике.
Один и тот же запросHubris
Проигрываем ответ на измеренной скорости: пауза до первого слова, потом письмо. Длина ответа одинаковая, иначе модели несравнимы.
Раунд 4 из 6
Цена
В рублях, за миллион токенов. Списывается по факту — за то, что реально отправили и получили.
Прайс и реальный средний чек Hubris
Первые две колонки — ставки каталога. Третья — сколько в среднем стоит один запрос нашим пользователям к этой модели.
| Модель | Входные токеныто, что вы отправили | Ответ моделито, что она написала | Типичный запроссредний по нашим пользователям |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | 17,69 | 35,38 | 0,31 |
| Grok 4.20 | 158 | 316 | 2,27 |
| Разница | в девять разв пользу DeepSeek 0731 | в девять разв пользу DeepSeek 0731 | в 7,3 разав пользу DeepSeek 0731 |
Раунд 5 из 6
Кэш
Если начало промпта повторяется от запроса к запросу — системная инструкция, приложенный документ, история переписки, — эта часть считается со скидкой. Включается она у моделей по-разному, и на этом легко потерять деньги.
Правила кэширования Поставщик
Скидка применяется автоматически — Hubris списывает по фактической цене исполнения, в которой кэш уже учтён.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 80 % применится сама.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 84 % применится сама.
cached_tokens.Раунд 6 из 6
Возможности
Контекст, что принимает на вход, рассуждения, приватность, надёжность. За каждый пункт — очки по одной шкале.
- ✓Контекст 1,31 млн токенов
- —Картинки не принимает
- —Файлы не принимает
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Доля неудачных запросов 0,3 %
- ✓Контекст 2 млн токенов
- ✓Принимает картинки
- ✓Принимает файлы
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Доля неудачных запросов 0,0 %
Итог
Кто победил
Коротко
Плюсы и минусы
Преимущества каждой модели над другой — из тех же данных, что и раунды, в процентах и секундах.
- дешевле в девять раз на входе
- качество без рассуждений выше на 24 %
- качество с рассуждениями выше на 27 %
- первое слово на 0,9 с раньше
- пишет на 18 % быстрее
- принимает картинки
- контекст больше на 34 %
Выбор
Когда какую брать
Обе доступны по одному ключу — переключиться можно на любом запросе, поменяв одну строку.
- Дешёвые массовые задачи с качеством выше апрельской версии
- Код и рассуждения на бюджете
- Фоновая обработка больших объёмов
- Массовые задачи, где счёт за токены — главная статья расходов
Слабое место: поставщик оставляет право учиться на присланном — не для рабочих документов.
- Диалог с людьми: первое слово появляется раньше
Вопросы
Что обычно спрашивают
Почему DeepSeek 0731 дешевле в девять раз — он хуже?
С включёнными рассуждениями разница по независимому индексу — 51.8 против 38; без рассуждений — 29.3 против 22.2. Причём без рассуждений DeepSeek 0731 даже впереди — переплата оправдана только особыми требованиями к задаче. Самый дешёвый способ убедиться — прогнать оба варианта на своих данных.
Какая модель лучше для написания кода?
По независимому индексу с рассуждениями — 51.8 против 38. На практике для больших проектов берут ту, что лучше держит длинный контекст задачи; DeepSeek 0731 здесь предпочтительнее, а для мелких правок и массовых операций важнее скорость и цена.
Что такое кэш промптов и почему это важно?
У обеих кэш включается сам: если начало промпта совпадает с недавним запросом, эта часть считается со скидкой. Ничего помечать не нужно.
Откуда взяты цифры скорости?
Это наши измерения по успешным запросам через Hubris за последние 30 дней, а не заявления поставщиков: время до первого слова и скорость письма от начала до конца ответа. В паузу входит и наш участок пути. Лабораторная дорожка рядом — Artificial Analysis, прямой API одним промптом: это потолок, наша цифра — то, на что стоит рассчитывать.
Можно ли переключаться между моделями?
Да, обе доступны по одному ключу. Чтобы сменить модель, достаточно поменять её идентификатор в запросе — ни отдельного договора, ни второго ключа не нужно.
Дальше
Другие сравнения
Каждая из этих двух — против соседей по каталогу. Любую пару можно собрать в выборе наверху страницы.
Источники: DeepSeek V4 Flash (Non-reasoning) и Grok 4.20 0309 v2 (Non-reasoning) — Artificial Analysis, 2026-08-25; цены, контекст и модальности — каталог Hubris, 2026-08-25; скорость и средний чек — запросы через Hubris за 30 дней.