hubris
Логотип Google Gemini — провайдер модели Google: Gemini 2.5 Flash Lite

Google: Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
google
Выпущена 22 июля 2025 г.|1.0М контекст|11,30 ₽/М вход|45,18 ₽/М выход

Gemini 2.5 Flash-Lite — это облегченная модель рассуждений в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она предлагает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность по сравнению с предыдущими моделями Flash в общих бенчмарках. По умолчанию «мышление» (то есть многопроходное рассуждение) отключено для приоритета скорости, но разработчики могут включить его с помощью параметра Reasoning API, чтобы выборочно обменять стоимость на интеллект.

Провайдер для Google: Gemini 2.5 Flash Lite

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
1.0М
токенов
Макс. ответ
66К
токенов
Вход
11,30 ₽
за 1М токенов
Выход
45,18 ₽
за 1М токенов
Кеш чтение
1,13 ₽
за 1М токенов
Кеш запись
9,41 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияФайлыАудиоВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
16,26 ₽
по запросам за 30 дней · за 1 млн токенов
Google AI Studio
5,65 ₽22,59 ₽0,560 ₽19 т/с98,9 %1,5 %
Google
11,30 ₽45,18 ₽1,13 ₽59 т/с98,6 %98,5 %
Google
11,30 ₽45,18 ₽1,13 ₽59 т/с98,7 %98,5 %
Google AI Studio
11,30 ₽45,18 ₽1,13 ₽19 т/с98,9 %1,5 %
Google AI Studio
20,33 ₽81,33 ₽2,03 ₽19 т/с98,9 %1,5 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 33,89 ₽/М

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

Gemini 3.1 Flash Image, также известный как "Nano Banana 2", — это новейшая передовая модель Google для генерации и редактирования изображений, обеспечивающая визуальное качество профессионального уровня на скорости Flash. Она сочетает в себе расширенное контекстное понимание с быстрым и экономичным выводом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API.

131К контекст·1,59 ₽ за запрос

Google: Gemini Omni Flash Preview

Gemini Omni Flash Preview — это нативная мультимодальная модель Google для генерации и редактирования видео. Она принимает текст, изображения и видео, а также генерирует короткие видеоролики в разрешении 720p с нативным звуком, поддерживая преобразование текста в видео,...

контекст·16,42 ₽ за секунду

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·1,59 ₽ за запрос

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.

1.0М контекст·1,59 ₽ за запрос

Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) — это самая быстрая и экономичная модель изображений Gemini от Google, созданная для высокоскоростных конвейеров разработчиков и быстрого визуального исследования. Она обеспечивает генерацию текста в изображение примерно за 4 секунды — примерно в 2,7 раза быстрее, чем Gemini 3.1 Flash Image — сохраняя при этом согласованность символов, точное редактирование и реальные знания семейства Nano Banana. Единый API обрабатывает генерацию текста в изображение, редактирование изображений и композицию из нескольких изображений. Как мультимодальная модель, она также возвращает текст вместе с изображениями. Выходные данные генерируются в разрешении 1K с 14 соотношениями сторон и содержат невидимый водяной знак SynthID, чтобы их можно было идентифицировать как сгенерированные ИИ. Позиционируемая как лучший баланс качества и скорости в линейке Nano Banana 2, она позволяет генерировать тысячи изображений за небольшую часть стоимости более тяжёлых производственных моделей — идеально подходит для прототипирования, приложений реального времени и визуальных рабочих процессов в масштабе.

66К контекст·от 28,24 ₽/М