Gemini 3.1 Pro Preview — это передовая модель рассуждений от Google, обеспечивающая повышенную производительность в области разработки программного обеспечения, улучшенную надёжность агентов и более эффективное использование токенов в сложных рабочих процессах. Основываясь на мультимодальной базе серии Gemini 3, она сочетает высокоточное рассуждение по тексту, изображениям, видео, аудио и коду с контекстным окном в 1M токенов. Детали рассуждений должны сохраняться при использовании многошаговых вызовов инструментов, см. нашу документацию здесь: [ссылка]. Обновление 3.1 обеспечивает измеримые улучшения в бенчмарках SWE и реальных средах кодирования, а также более сильное автономное выполнение задач в структурированных областях, таких как финансы и рабочие процессы на основе электронных таблиц.
Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview улучшает стабильность на длительных горизонтах и оркестрацию инструментов, одновременно повышая эффективность токенов. Она вводит новый средний уровень мышления для лучшего баланса стоимости, скорости и производительности. Модель превосходно справляется с агентным кодированием, структурированным планированием, мультимодальным анализом и автоматизацией рабочих процессов, что делает её хорошо подходящей для автономных агентов, финансового моделирования, автоматизации электронных таблиц и корпоративных задач с высоким контекстом.
Провайдер для Google: Gemini 3.1 Pro Preview
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Google | 126,24 ₽ | 757,42 ₽ | 12,62 ₽ | — | 2,5 % |
Google AI Studio | 126,24 ₽ | 757,42 ₽ | 12,62 ₽ | — | 99,9 % |
Google | 252,47 ₽ | 1 514,84 ₽ | 25,25 ₽ | — | 98,3 % |
Google AI Studio | 252,47 ₽ | 1 514,84 ₽ | 25,25 ₽ | — | 99,9 % |
Google | 454,45 ₽ | 2 726,71 ₽ | 45,45 ₽ | — | 99,9 % |
Google AI Studio | 454,45 ₽ | 2 726,71 ₽ | 45,45 ₽ | — | 99,6 % |
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от google
Google: Nano Banana 2 (Gemini 3.1 Flash Image)
Gemini 3.1 Flash Image, также известный как "Nano Banana 2", — это новейшая передовая модель Google для генерации и редактирования изображений, обеспечивающая визуальное качество профессионального уровня на скорости Flash. Она сочетает в себе расширенное контекстное понимание с быстрым и экономичным выводом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API.
Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) — это самая быстрая и экономичная модель изображений Gemini от Google, созданная для высокоскоростных конвейеров разработчиков и быстрого визуального исследования. Она обеспечивает генерацию текста в изображение примерно за 4 секунды — примерно в 2,7 раза быстрее, чем Gemini 3.1 Flash Image — сохраняя при этом согласованность символов, точное редактирование и реальные знания семейства Nano Banana. Единый API обрабатывает генерацию текста в изображение, редактирование изображений и композицию из нескольких изображений. Как мультимодальная модель, она также возвращает текст вместе с изображениями. Выходные данные генерируются в разрешении 1K с 14 соотношениями сторон и содержат невидимый водяной знак SynthID, чтобы их можно было идентифицировать как сгенерированные ИИ. Позиционируемая как лучший баланс качества и скорости в линейке Nano Banana 2, она позволяет генерировать тысячи изображений за небольшую часть стоимости более тяжёлых производственных моделей — идеально подходит для прототипирования, приложений реального времени и визуальных рабочих процессов в масштабе.
Google: Gemini 3.7 Flash
Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых агентных рабочих процессов, кодирования и сложного многошагового рассуждения. Она разработана для задач, требующих высокой производительности и надёжного многошагового решения проблем.
Google: Nano Banana Pro (Gemini 3 Pro Image)
Nano Banana Pro — это самая передовая модель Google для генерации и редактирования изображений, построенная на базе Gemini 3 Pro. Она расширяет возможности оригинальной Nano Banana за счет значительно улучшенного мультимодального мышления, привязки к реальному миру и высококачественного визуального синтеза. Модель генерирует контекстно-обогащенную графику, от инфографики и диаграмм до кинематографических композиций, и может включать информацию в реальном времени посредством привязки к Поиску. Она предлагает лучшее в отрасли отображение текста на изображениях (включая длинные отрывки и многоязычные макеты), последовательное смешивание нескольких изображений и точное сохранение идентичности до пяти объектов. Nano Banana Pro добавляет детальные творческие элементы управления, такие как локализованное редактирование, настройка освещения и фокуса, преобразования камеры, а также поддержку вывода 2K/4K и гибких соотношений сторон. Она разработана для профессионального дизайна, визуализации продуктов, раскадровки и сложных многоэлементных композиций, оставаясь при этом эффективной для общих рабочих процессов создания изображений.
Google: Gemini 3.8 Flash
Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями по сравнению с 3.7 Flash в области разработки программного обеспечения, агентных задач и многоэтапных рассуждений.
Google: Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite — это высокоэффективная мультимодальная модель Google, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом. Она поддерживает ввод текста, изображений, видео, аудио и PDF-файлов, а также предназначена для легковесных агентских рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются скорость отклика и стоимость API. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности.