Claude Opus 5илиGemini 3.6 Flash
Главная разница — цена: Flash дешевле в 6,7 раза на входе и в 6,7 раза на выходе. Ниже — счёт по трём источникам: что заявили поставщики, что намерила независимая лаборатория и что мы видим на реальных запросах. Переключатель «что важнее» меняет счёт — проверьте свой расклад.
- Поставщик карточки моделей и правила кэша
- Лаборатория Artificial Analysis, одна методика на обе
- Hubris наши реальные запросы за 30 дней
Сводная оценка Лаборатория Hubris
Одно число на модель от 0 до 100: качество, скорость, цена, кэш и возможности, нормированные по всему каталогу. Засечки — остальные модели на той же шкале.
Opus опережает Flash на 12 % по сводной оценке при выбранных весах. Из чего складывается — в раундах ниже.
Счёт по раундам 29 : 37
Раунд 1 из 6
Качество с рассуждениями
Качество мы не измеряем — это цифры независимой лаборатории: девять тестов одной методикой на обе модели, рассуждения включены на максимум. Шкала от 0 до 100.
Индекс интеллекта Лаборатория
Artificial Analysis, индекс v4. Замеры: Claude Opus 5 (Adaptive Reasoning, Max Effort), Gemini 3.6 Flash (high).
Раунд 2 из 6
Качество без рассуждений
В чате, поддержке и массовых задачах думать некогда — рассуждения выключены. Здесь картина часто другая.
Индекс интеллекта Лаборатория
Та же методика, режим без рассуждений.
Лаборатория ещё не измерила Claude Opus 5 в этом режиме — раунд в счёт не идёт.
Раунд 3 из 6
Скорость
Пауза до первого слова и скорость письма. Очки — по нашим данным, это то, что вы получите на практике.
Один и тот же запросHubris
Проигрываем ответ на измеренной скорости: пауза до первого слова, потом письмо. Длина ответа одинаковая, иначе модели несравнимы.
По Claude Opus 5 пока мало запросов, чтобы мерить скорость.
Раунд 4 из 6
Цена
В рублях, за миллион токенов. Списывается по факту — за то, что реально отправили и получили.
Прайс и реальный средний чек Hubris
Первые две колонки — ставки каталога. Третья — сколько в среднем стоит один запрос нашим пользователям к этой модели.
| Модель | Входные токеныто, что вы отправили | Ответ моделито, что она написала | Типичный запроссредний по нашим пользователям |
|---|---|---|---|
| Claude Opus 5 | 632 | 3 159 | мало данных |
| Gemini 3.6 Flash | 94,77 | 474 | 1,93 |
| Разница | в 6,7 разав пользу Flash | в 6,7 разав пользу Flash | — |
Раунд 5 из 6
Кэш
Если начало промпта повторяется от запроса к запросу — системная инструкция, приложенный документ, история переписки, — эта часть считается со скидкой. Включается она у моделей по-разному, и на этом легко потерять деньги.
Правила кэширования Поставщик
Скидка применяется автоматически — Hubris списывает по фактической цене исполнения, в которой кэш уже учтён.
Кэшируется только то, что вы пометили. Ставите cache_control на повторяющийся блок — от 1024 токенов, живёт около пяти минут. Чтение из кэша на 90 % дешевле. Не пометили — платите полную цену, даже если промпт повторяется слово в слово.
Повторяющееся начало промпта кэшируется само. Ничего помечать не нужно: если первые токены совпадают с недавним запросом, скидка 90 % применится сама.
cached_tokens.Раунд 6 из 6
Возможности
Контекст, что принимает на вход, рассуждения, приватность, надёжность. За каждый пункт — очки по одной шкале.
- ✓Контекст 1 млн токенов
- ✓Принимает картинки
- ✓Принимает файлы
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Контекст 1,05 млн токенов
- ✓Принимает картинки
- ✓Принимает файлы
- ✓Умеет рассуждать перед ответом
- ✓Не обучается на ваших данных
- ✓Доля неудачных запросов 1,9 %
Итог
Кто победил
Коротко
Плюсы и минусы
Преимущества каждой модели над другой — из тех же данных, что и раунды, в процентах и секундах.
- качество с рассуждениями выше на 18 %
- дешевле в 6,7 раза на входе
- кэш включается сам, без пометок в запросе
Выбор
Когда какую брать
Обе доступны по одному ключу — переключиться можно на любом запросе, поменяв одну строку.
- Самые сложные задачи: архитектура, исследование, длинные рассуждения
- Код, где цена ошибки высока и нужна лучшая модель линейки
- Многошаговые агенты с большим контекстом
- Сложные задачи, где модели дают подумать: код, анализ, агенты
Слабое место: самая дорогая модель каталога — для потока запросов не подходит.
- Массовые задачи, где счёт за токены — главная статья расходов
Вопросы
Что обычно спрашивают
Почему Flash дешевле в 6,7 раза — он хуже?
По независимому индексу с рассуждениями — 63.1 против 51.6; второй режим лаборатория для одной из моделей ещё не измерила. Цена отражает размер модели и объём вычислений на ответ; проверьте на своих данных, заметна ли разница именно в вашей задаче.
Какая модель лучше для написания кода?
По независимому индексу с рассуждениями — 63.1 против 51.6. На практике для больших проектов берут ту, что лучше держит длинный контекст задачи; Opus здесь предпочтительнее, а для мелких правок и массовых операций важнее скорость и цена.
Что такое кэш промптов и почему это важно?
У Flash кэш включается сам. У Opus повторяющийся блок нужно пометить маркером cache_control, иначе скидки не будет — одна строка в запросе, а на массовых задачах разница в счёте в разы.
Откуда взяты цифры скорости?
Это наши измерения по успешным запросам через Hubris за последние 30 дней, а не заявления поставщиков: время до первого слова и скорость письма от начала до конца ответа. В паузу входит и наш участок пути. Лабораторная дорожка рядом — Artificial Analysis, прямой API одним промптом: это потолок, наша цифра — то, на что стоит рассчитывать.
Можно ли переключаться между моделями?
Да, обе доступны по одному ключу. Чтобы сменить модель, достаточно поменять её идентификатор в запросе — ни отдельного договора, ни второго ключа не нужно.
Дальше
Другие сравнения
Каждая из этих двух — против соседей по каталогу. Любую пару можно собрать в выборе наверху страницы.
Источники: Claude Opus 5 (Adaptive Reasoning, Max Effort) и Gemini 3.6 Flash (high) — Artificial Analysis, 2026-08-25; цены, контекст и модальности — каталог Hubris, 2026-08-25; скорость и средний чек — запросы через Hubris за 30 дней.