hubris
Логотип Google Gemini — провайдер модели Google: Gemini 3.1 Flash Lite (batch)

Google: Gemini 3.1 Flash Lite (batch)

google/gemini-3.1-flash-lite:batch
google
Выпущена 7 мая 2026 г.|1.0М контекст|1,77 ₽ за 1k calls

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом. Она поддерживает ввод текста, изображений, видео, аудио и PDF-файлов, а также предназначена для легковесных агентских рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются скорость отклика и стоимость API. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности.

Провайдер для Google: Gemini 3.1 Flash Lite (batch)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
1.0М
токенов
Макс. ответ
66К
токенов
Вход
15,80 ₽
за 1М токенов
Выход
94,77 ₽
за 1М токенов
Веб-поиск
1,77 ₽
за 1k calls
Кеш чтение
1,58 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоФайлыАудиоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Google
15,80 ₽94,77 ₽1,58 ₽

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 37,91 ₽/М

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.

1.0М контекст·1,77 ₽ за 1k calls

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

1.0М контекст·1,77 ₽ за 1k calls

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·1,77 ₽ за 1k calls

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и меньшей неопределенностью, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·1,77 ₽ за 1k calls

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.

1.0М контекст·1,77 ₽ за 1k calls