hubris
Логотип Google Gemini — провайдер модели Google: Gemma 4 31B

Google: Gemma 4 31B

google/gemma-4-31b-it
google
Выпущена 2 апреля 2026 г.|262К контекст|11,37 ₽/М вход|42,96 ₽/М выход

Gemma 4 31B Instruct — это плотная мультимодальная модель Google DeepMind с 30,7 млрд параметров, поддерживающая ввод текста и изображений с выводом текста. Она имеет контекстное окно в 256 тысяч токенов, настраиваемый режим мышления/рассуждения, нативную поддержку вызова функций и многоязычную поддержку более чем на 140 языках. Модель демонстрирует высокие результаты в задачах кодирования, рассуждения и понимания документов. Лицензия Apache 2.0.

Провайдер для Google: Gemma 4 31B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
262К
токенов
Макс. ответ
16К
токенов
Вход
11,37 ₽
за 1М токенов
Выход
42,96 ₽
за 1М токенов
Кеш чтение
6,32 ₽
за 1М токенов

Модальности

Вход:ИзображенияТекстВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DeepInfra
11,37 ₽42,96 ₽6,32 ₽99,9 %
CoreWeave
12,64 ₽42,96 ₽12,64 ₽99,4 %
Venice
15,16 ₽45,49 ₽11,37 ₽99,5 %
Chutes
15,16 ₽46,75 ₽1,52 ₽95,8 %
DeepInfra
16,43 ₽48,02 ₽98,0 %
SiliconFlow
16,43 ₽50,54 ₽95,9 %
Crusoe
17,69 ₽50,54 ₽17,69 ₽94,0 %
Friendli
17,69 ₽50,54 ₽99,9 %
Novita
17,69 ₽50,54 ₽93,2 %
Parasail
18,95 ₽50,54 ₽7,58 ₽99,2 %
DeepInfra
34,12 ₽96,03 ₽90,1 %
SambaNova
48,02 ₽145,31 ₽97,2 %
Together
49,28 ₽122,57 ₽98,4 %
ModelRun
94,77 ₽126,36 ₽94,77 ₽100,0 %
Cerebras
125,10 ₽188,28 ₽125,10 ₽100,0 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 37,91 ₽/М

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многошаговых рассуждений.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 94,77 ₽/М