hubris
Логотип Google Gemini — провайдер модели Google: Gemini 3.1 Flash Lite

Google: Gemini 3.1 Flash Lite

google/gemini-3.1-flash-lite
google
Выпущена 7 мая 2026 г.|1.0М контекст|31,59 ₽/М вход|189,54 ₽/М выход

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом. Она поддерживает ввод текста, изображений, видео, аудио и PDF-файлов, а также предназначена для легковесных агентских рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются скорость отклика и стоимость API.

Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности.

Провайдер для Google: Gemini 3.1 Flash Lite

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
1.0М
токенов
Макс. ответ
66К
токенов
Вход
31,59 ₽
за 1М токенов
Выход
189,54 ₽
за 1М токенов
Кеш чтение
3,16 ₽
за 1М токенов
Кеш запись
10,53 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоФайлыАудиоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
38,64 ₽
по запросам за 30 дней · за 1 млн токенов
Google
15,80 ₽94,77 ₽1,58 ₽42 т/с98,0 %51,4 %
Google AI Studio
15,80 ₽94,77 ₽1,58 ₽42 т/с99,5 %48,6 %
Google
31,59 ₽189,54 ₽3,16 ₽42 т/с98,0 %51,4 %
Google AI Studio
31,59 ₽189,54 ₽3,16 ₽42 т/с99,5 %48,6 %
Google
34,75 ₽208,50 ₽3,47 ₽42 т/с100,0 %51,4 %
Google
56,86 ₽341,17 ₽5,69 ₽42 т/с98,0 %51,4 %
Google AI Studio
56,86 ₽341,17 ₽5,69 ₽42 т/с99,5 %48,6 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 37,91 ₽/М

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.

1.0М контекст·от 23,69 ₽/М

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и меньшей неопределенностью, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.

1.0М контекст·от 37,91 ₽/М