Gemma 4 31B Instruct — это плотная мультимодальная модель Google DeepMind с 30,7 млрд параметров, поддерживающая ввод текста и изображений с выводом текста. Она имеет контекстное окно в 256 тысяч токенов, настраиваемый режим мышления/рассуждения, нативную поддержку вызова функций и многоязычную поддержку более чем на 140 языках. Модель демонстрирует высокие результаты в задачах кодирования, рассуждения и понимания документов. Лицензия Apache 2.0.
Провайдер для Google: Gemma 4 31B
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
DeepInfra | 11,37 ₽ | 42,96 ₽ | 6,32 ₽ | — | 99,9 % |
CoreWeave | 12,64 ₽ | 42,96 ₽ | 12,64 ₽ | — | 99,4 % |
Venice | 15,16 ₽ | 45,49 ₽ | 11,37 ₽ | — | 99,5 % |
Chutes | 15,16 ₽ | 46,75 ₽ | 1,52 ₽ | — | 95,8 % |
DeepInfra | 16,43 ₽ | 48,02 ₽ | — | — | 98,0 % |
SiliconFlow | 16,43 ₽ | 50,54 ₽ | — | — | 95,9 % |
Crusoe | 17,69 ₽ | 50,54 ₽ | 17,69 ₽ | — | 94,0 % |
Friendli | 17,69 ₽ | 50,54 ₽ | — | — | 99,9 % |
Novita | 17,69 ₽ | 50,54 ₽ | — | — | 93,2 % |
Parasail | 18,95 ₽ | 50,54 ₽ | 7,58 ₽ | — | 99,2 % |
DeepInfra | 34,12 ₽ | 96,03 ₽ | — | — | 90,1 % |
SambaNova | 48,02 ₽ | 145,31 ₽ | — | — | 97,2 % |
Together | 49,28 ₽ | 122,57 ₽ | — | — | 98,4 % |
ModelRun | 94,77 ₽ | 126,36 ₽ | 94,77 ₽ | — | 100,0 % |
Cerebras | 125,10 ₽ | 188,28 ₽ | 125,10 ₽ | — | 100,0 % |
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от google
Google: Gemini 2.5 Flash
Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.
Google: Gemini 3.8 Flash (batch)
Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многошаговых рассуждений.
Google: Gemini 3.8 Flash
Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.
Google: Gemini 3.7 Flash (batch)
Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных рабочих процессов, кодирования и сложного многоэтапного рассуждения. Она разработана для задач, требующих быстрой производительности и надёжного многоэтапного решения проблем.
Google: Gemini 3.7 Flash
Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.
Google: Gemini 3.6 Flash
Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.