Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом. Она поддерживает ввод текста, изображений, видео, аудио и PDF-файлов, а также предназначена для легковесных агентских рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются скорость отклика и стоимость API.
Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности.
Провайдер для Google: Gemini 3.1 Flash Lite
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Google | 15,80 ₽ | 94,77 ₽ | 1,58 ₽ | 42 т/с | 98,0 % | 51,4 % |
Google AI Studio | 15,80 ₽ | 94,77 ₽ | 1,58 ₽ | 42 т/с | 99,5 % | 48,6 % |
Google | 31,59 ₽ | 189,54 ₽ | 3,16 ₽ | 42 т/с | 98,0 % | 51,4 % |
Google AI Studio | 31,59 ₽ | 189,54 ₽ | 3,16 ₽ | 42 т/с | 99,5 % | 48,6 % |
Google | 34,75 ₽ | 208,50 ₽ | 3,47 ₽ | 42 т/с | 100,0 % | 51,4 % |
Google | 56,86 ₽ | 341,17 ₽ | 5,69 ₽ | 42 т/с | 98,0 % | 51,4 % |
Google AI Studio | 56,86 ₽ | 341,17 ₽ | 5,69 ₽ | 42 т/с | 99,5 % | 48,6 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Другие модели от google
Google: Gemini 2.5 Flash
Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.
Google: Gemini 3.7 Flash (batch)
Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.
Google: Gemini 3.7 Flash
Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.
Google: Gemini 3.6 Flash (batch)
Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и меньшей неопределенностью, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.
Google: Gemini 3.6 Flash
Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.
Google: Gemini 3.5 Flash Lite
Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.