Gemini 3.1 Pro Preview — это передовая модель рассуждений от Google, обеспечивающая повышенную производительность в области разработки программного обеспечения, улучшенную надёжность агентов и более эффективное использование токенов в сложных рабочих процессах. Основываясь на мультимодальной базе серии Gemini 3, она сочетает высокоточное рассуждение по тексту, изображениям, видео, аудио и коду с контекстным окном в 1M токенов. Детали рассуждений должны сохраняться при использовании многошаговых вызовов инструментов, см. нашу документацию здесь: [ссылка]. Обновление 3.1 обеспечивает измеримые улучшения в бенчмарках SWE и реальных средах кодирования, а также более сильное автономное выполнение задач в структурированных областях, таких как финансы и рабочие процессы на основе электронных таблиц.
Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview улучшает стабильность на длительных горизонтах и оркестрацию инструментов, одновременно повышая эффективность токенов. Она вводит новый средний уровень мышления для лучшего баланса стоимости, скорости и производительности. Модель превосходно справляется с агентным кодированием, структурированным планированием, мультимодальным анализом и автоматизацией рабочих процессов, что делает её хорошо подходящей для автономных агентов, финансового моделирования, автоматизации электронных таблиц и корпоративных задач с высоким контекстом.
Провайдер для Google: Gemini 3.1 Pro Preview
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Google | 112,96 ₽ | 677,75 ₽ | 11,30 ₽ | 132 т/с | 96,9 % | 100,0 % |
Google AI Studio | 112,96 ₽ | 677,75 ₽ | 11,30 ₽ | — | 99,2 % | < 0,1 % |
Google | 225,92 ₽ | 1 355,51 ₽ | 22,59 ₽ | 132 т/с | 96,9 % | 100,0 % |
Google AI Studio | 225,92 ₽ | 1 355,51 ₽ | 22,59 ₽ | — | 99,2 % | < 0,1 % |
Google | 406,65 ₽ | 2 439,91 ₽ | 40,67 ₽ | 132 т/с | 96,9 % | 100,0 % |
Google AI Studio | 406,65 ₽ | 2 439,91 ₽ | 40,67 ₽ | — | 99,2 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Другие модели от google
Google: Gemini 2.5 Flash
Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.
Google: Nano Banana 2 (Gemini 3.1 Flash Image)
Gemini 3.1 Flash Image, также известный как "Nano Banana 2", — это новейшая передовая модель Google для генерации и редактирования изображений, обеспечивающая визуальное качество профессионального уровня на скорости Flash. Она сочетает в себе расширенное контекстное понимание с быстрым и экономичным выводом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API.
Google: Gemini 2.5 Flash Lite
Gemini 2.5 Flash-Lite — это облегченная модель рассуждений в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она предлагает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность по сравнению с предыдущими моделями Flash в общих бенчмарках. По умолчанию «мышление» (то есть многопроходное рассуждение) отключено для приоритета скорости, но разработчики могут включить его с помощью параметра Reasoning API, чтобы выборочно обменять стоимость на интеллект.
Google: Gemini Omni Flash Preview
Gemini Omni Flash Preview — это нативная мультимодальная модель Google для генерации и редактирования видео. Она принимает текст, изображения и видео, а также генерирует короткие видеоролики в разрешении 720p с нативным звуком, поддерживая преобразование текста в видео,...
Google: Gemini 3.6 Flash
Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.
Google: Gemini 3.5 Flash Lite
Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.