hubris
Логотип Google Gemini — провайдер модели Google: Gemma 4 31B

Google: Gemma 4 31B

google/gemma-4-31b-it
google
Выпущена 2 апреля 2026 г.|262К контекст|11,36 ₽/М вход|42,92 ₽/М выход

Gemma 4 31B Instruct — это плотная мультимодальная модель Google DeepMind с 30,7 млрд параметров, поддерживающая ввод текста и изображений с выводом текста. Она имеет контекстное окно в 256 тысяч токенов, настраиваемый режим мышления/рассуждения, нативную поддержку вызова функций и многоязычную поддержку более чем на 140 языках. Модель демонстрирует высокие результаты в задачах кодирования, рассуждения и понимания документов. Лицензия Apache 2.0.

Провайдер для Google: Gemma 4 31B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
262К
токенов
Макс. ответ
16К
токенов
Вход
11,36 ₽
за 1М токенов
Выход
42,92 ₽
за 1М токенов
Кеш чтение
6,31 ₽
за 1М токенов

Модальности

Вход:ИзображенияТекстВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DeepInfra
11,36 ₽42,92 ₽6,31 ₽99,2 %
CoreWeave
12,62 ₽42,92 ₽12,62 ₽97,4 %
Venice
15,15 ₽45,45 ₽11,36 ₽98,4 %
Chutes
15,15 ₽46,71 ₽1,51 ₽92,2 %
DeepInfra
16,41 ₽47,97 ₽98,6 %
Crusoe
17,67 ₽50,49 ₽17,67 ₽97,5 %
Friendli
17,67 ₽50,49 ₽99,3 %
Novita
17,67 ₽50,49 ₽91,6 %
Parasail
18,94 ₽50,49 ₽7,57 ₽99,5 %
DeepInfra
34,08 ₽95,94 ₽47,9 %
SambaNova
47,97 ₽145,17 ₽95,8 %
Together
49,23 ₽122,45 ₽
ModelRun
94,68 ₽126,24 ₽94,68 ₽99,9 %
SiliconFlow
94,68 ₽126,24 ₽31,56 ₽81,3 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от google

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

Gemini 3.1 Flash Image, также известный как "Nano Banana 2", — это новейшая передовая модель Google для генерации и редактирования изображений, обеспечивающая визуальное качество профессионального уровня на скорости Flash. Она сочетает в себе расширенное контекстное понимание с быстрым и экономичным выводом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API.

131К контекст·от 63,12 ₽/М

Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) — это самая быстрая и экономичная модель изображений Gemini от Google, созданная для высокоскоростных конвейеров разработчиков и быстрого визуального исследования. Она обеспечивает генерацию текста в изображение примерно за 4 секунды — примерно в 2,7 раза быстрее, чем Gemini 3.1 Flash Image — сохраняя при этом согласованность символов, точное редактирование и реальные знания семейства Nano Banana. Единый API обрабатывает генерацию текста в изображение, редактирование изображений и композицию из нескольких изображений. Как мультимодальная модель, она также возвращает текст вместе с изображениями. Выходные данные генерируются в разрешении 1K с 14 соотношениями сторон и содержат невидимый водяной знак SynthID, чтобы их можно было идентифицировать как сгенерированные ИИ. Позиционируемая как лучший баланс качества и скорости в линейке Nano Banana 2, она позволяет генерировать тысячи изображений за небольшую часть стоимости более тяжёлых производственных моделей — идеально подходит для прототипирования, приложений реального времени и визуальных рабочих процессов в масштабе.

66К контекст·от 31,56 ₽/М

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

1.0М контекст·от 94,68 ₽/М

Google: Nano Banana Pro (Gemini 3 Pro Image)

Nano Banana Pro — это самая передовая модель Google для генерации и редактирования изображений, построенная на базе Gemini 3 Pro. Она расширяет возможности оригинальной Nano Banana за счет значительно улучшенного мультимодального мышления, привязки к реальному миру и высококачественного визуального синтеза. Модель генерирует контекстно-обогащенную графику, от инфографики и диаграмм до кинематографических композиций, и может включать информацию в реальном времени посредством привязки к Поиску. Она предлагает лучшее в отрасли отображение текста на изображениях (включая длинные отрывки и многоязычные макеты), последовательное смешивание нескольких изображений и точное сохранение идентичности до пяти объектов. Nano Banana Pro добавляет детальные творческие элементы управления, такие как локализованное редактирование, настройка освещения и фокуса, преобразования камеры, а также поддержку вывода 2K/4K и гибких соотношений сторон. Она разработана для профессионального дизайна, визуализации продуктов, раскадровки и сложных многоэлементных композиций, оставаясь при этом эффективной для общих рабочих процессов создания изображений.

131К контекст·от 252,47 ₽/М

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.

1.0М контекст·от 94,68 ₽/М

Google: Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом. Она поддерживает ввод текста, изображений, видео, аудио и PDF-файлов, а также предназначена для легковесных агентских рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются скорость отклика и стоимость API. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности.

1.0М контекст·от 31,56 ₽/М