hubris
Логотип Google Gemini — провайдер модели Google: Gemini 3.7 Flash

Google: Gemini 3.7 Flash

google/gemini-3.7-flash
google
Выпущена 13 августа 2026 г.|1.0М контекст|94,77 ₽/М вход|473,85 ₽/М выход

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

Провайдер для Google: Gemini 3.7 Flash

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
1.0М
токенов
Макс. ответ
66К
токенов
Вход
94,77 ₽
за 1М токенов
Выход
473,85 ₽
за 1М токенов
Кеш чтение
9,48 ₽
за 1М токенов
Кеш запись
5,27 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоФайлыАудиоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
36,56 ₽
по запросам за 30 дней · за 1 млн токенов
Google50 %
94,78 ₽47,39 ₽473,86 ₽236,93 ₽9,48 ₽4,74 ₽91 т/с59,4 %94,6 %
Google AI Studio50 %
94,78 ₽47,39 ₽473,86 ₽236,93 ₽9,48 ₽4,74 ₽31 т/с99,2 %5,4 %
Google AI Studio50 %
189,54 ₽94,77 ₽947,70 ₽473,85 ₽18,96 ₽9,48 ₽31 т/с99,2 %5,4 %
Google50 %
189,54 ₽94,77 ₽947,70 ₽473,85 ₽18,96 ₽9,48 ₽91 т/с99,3 %94,6 %
Google50 %
341,18 ₽170,59 ₽1 705,88 ₽852,94 ₽34,12 ₽17,06 ₽91 т/с98,5 %94,6 %
Google AI Studio50 %
341,18 ₽170,59 ₽1 705,88 ₽852,94 ₽34,12 ₽17,06 ₽31 т/с99,8 %5,4 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 37,91 ₽/М

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многошаговых рассуждений.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и меньшей неопределенностью, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 47,39 ₽/М