hubris
Логотип Google Gemini — провайдер модели Google: Gemma 4 31B (batch)

Google: Gemma 4 31B (batch)

google/gemma-4-31b-it:batch
google
Выпущена 2 апреля 2026 г.|262К контекст|49,28 ₽/М вход|122,57 ₽/М выход

Gemma 4 31B Instruct — это плотная мультимодальная модель Google DeepMind с 30,7B параметрами, поддерживающая ввод текста и изображений с текстовым выводом. Она имеет контекстное окно в 256K токенов, настраиваемый режим мышления/рассуждения, нативную поддержку вызова функций и многоязычную поддержку для более чем 140 языков. Модель демонстрирует высокую производительность в задачах кодирования, рассуждения и понимания документов. Лицензия Apache 2.0.

Провайдер для Google: Gemma 4 31B (batch)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
49,28 ₽
за 1М токенов
Выход
122,57 ₽
за 1М токенов

Модальности

Вход:ИзображенияТекстВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Together
49,28 ₽122,57 ₽

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 37,91 ₽/М

Google: Gemini 3.7 Flash

Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многошаговых рассуждений.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.

1.0М контекст·от 94,77 ₽/М

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.

1.0М контекст·от 47,39 ₽/М

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·от 94,77 ₽/М