Google: Gemini 3 Flash Preview

google/gemini-3-flash-preview

Выпущена 17 декабря 2025 г.|1.0М контекст|1,59 ₽ за запрос

Gemini 3 Flash Preview — это высокоскоростная, высокоэффективная модель мышления, разработанная для агентских рабочих процессов, многоходовых чатов и помощи в кодировании. Она обеспечивает производительность рассуждений и использования инструментов, близкую к уровню Pro, со значительно меньшей задержкой, чем более крупные варианты Gemini, что делает ее хорошо подходящей для интерактивной разработки, длительных агентских циклов и совместных задач кодирования. По сравнению с Gemini 2.5 Flash, она обеспечивает широкие улучшения качества в рассуждениях, мультимодальном понимании и надежности.

Модель поддерживает контекстное окно в 1M токенов и мультимодальные входы, включая текст, изображения, аудио, видео и PDF-файлы, с текстовым выводом. Она включает настраиваемые рассуждения через уровни мышления (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирована для пользователей, которым нужны сильные рассуждения и агентское поведение без затрат или задержек полномасштабных передовых моделей.

Провайдер для Google: Gemini 3 Flash Preview

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

google

Latency

—

Throughput

—

Uptime

—

Контекст

1.0М

токенов

Макс. ответ

66К

токенов

Веб-поиск

1,59 ₽

за запрос

Кеш чтение

5,65 ₽

за 1М токенов

Кеш запись

9,41 ₽

за 1М токенов

Модальности

Вход:ТекстИзображенияФайлыАудиоВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена

126,02 ₽

по запросам за 30 дней · за 1 млн токенов


Google	28,24 ₽	169,44 ₽	2,82 ₽	81 т/с	98,5 %	100,0 %
Google AI Studio	28,24 ₽	169,44 ₽	2,82 ₽	—	99,8 %	< 0,1 %
Google	56,48 ₽	338,88 ₽	5,65 ₽	81 т/с	98,5 %	100,0 %
Google AI Studio	56,48 ₽	338,88 ₽	5,65 ₽	—	99,8 %	< 0,1 %
Google	101,66 ₽	609,98 ₽	10,17 ₽	81 т/с	98,5 %	100,0 %
Google AI Studio	101,66 ₽	609,98 ₽	10,17 ₽	—	99,8 %	< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Тарификация для Google: Gemini 3 Flash Preview

Цены в рублях за единицу тарификации модели. Списание — за фактическое использование, без подписок.

Тип	Цена в ₽	Единица
Аудио на входе	112,96 ₽	за 1М токенов
Веб-поиск	1,58 ₽	за запрос
Кэш: чтение	5,65 ₽	за 1М токенов
Аудио из кэша	11,30 ₽	за 1М токенов
Кэш: запись	9,41 ₽	за 1М токенов
Reasoning	338,88 ₽	за 1М токенов
Веб-поиск	1,59 ₽	за запрос

Пример кода и API для Google: Gemini 3 Flash Preview

Hubris — OpenAI-совместимый API. Используйте любой OpenAI SDK, поменяв только base URL и ключ.

Получить API-ключ

curl https://api.hubris.pw/v1/chat/completions \
  -H "Authorization: Bearer sk-gw-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemini-3-flash-preview",
    "messages": [{"role": "user", "content": "Привет"}]
  }'

curl https://api.hubris.pw/v1/chat/completions \  -H "Authorization: Bearer sk-gw-..." \  -H "Content-Type: application/json" \  -d '{    "model": "google/gemini-3-flash-preview",    "messages": [{"role": "user", "content": "Привет"}]  }'

from openai import OpenAI

client = OpenAI(
    base_url="https://api.hubris.pw/v1",
    api_key="sk-gw-...",
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Привет"}],
)
print(response.choices[0].message.content)

from openai import OpenAIclient = OpenAI(    base_url="https://api.hubris.pw/v1",    api_key="sk-gw-...",)response = client.chat.completions.create(    model="google/gemini-3-flash-preview",    messages=[{"role": "user", "content": "Привет"}],)print(response.choices[0].message.content)

import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.hubris.pw/v1",
  apiKey: process.env.HUBRIS_API_KEY!,
});

const response = await client.chat.completions.create({
  model: "google/gemini-3-flash-preview",
  messages: [{ role: "user", content: "Привет" }],
});

console.log(response.choices[0].message.content);

import OpenAI from "openai";const client = new OpenAI({  baseURL: "https://api.hubris.pw/v1",  apiKey: process.env.HUBRIS_API_KEY!,});const response = await client.chat.completions.create({  model: "google/gemini-3-flash-preview",  messages: [{ role: "user", content: "Привет" }],});console.log(response.choices[0].message.content);

Другие модели от google

Google: Gemini 2.5 Flash

Gemini 2.5 Flash — это передовая рабочая модель Google, специально разработанная для решения сложных задач в области рассуждений, кодирования, математики и науки. Она включает встроенные возможности «мышления», что позволяет ей предоставлять ответы с большей точностью и тонким учётом контекста. Кроме того, Gemini 2.5 Flash настраивается с помощью параметра «max tokens for reasoning», как описано в документации.

1.0М контекст·от 33,89 ₽/М

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

Gemini 3.1 Flash Image, также известный как "Nano Banana 2", — это новейшая передовая модель Google для генерации и редактирования изображений, обеспечивающая визуальное качество профессионального уровня на скорости Flash. Она сочетает в себе расширенное контекстное понимание с быстрым и экономичным выводом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API.

131К контекст·1,59 ₽ за запрос

Google: Gemini 2.5 Flash Lite

Gemini 2.5 Flash-Lite — это облегченная модель рассуждений в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она предлагает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность по сравнению с предыдущими моделями Flash в общих бенчмарках. По умолчанию «мышление» (то есть многопроходное рассуждение) отключено для приоритета скорости, но разработчики могут включить его с помощью параметра Reasoning API, чтобы выборочно обменять стоимость на интеллект.

1.0М контекст·от 11,30 ₽/М

Google: Gemini Omni Flash Preview

Gemini Omni Flash Preview — это нативная мультимодальная модель Google для генерации и редактирования видео. Она принимает текст, изображения и видео, а также генерирует короткие видеоролики в разрешении 720p с нативным звуком, поддерживая преобразование текста в видео,...

— контекст·16,42 ₽ за секунду

Google: Gemini 3.6 Flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для кодирования, агентских рабочих процессов, а также веб- и мобильной разработки. Она разработана для создания отточенных результатов с меньшим количеством ненужных правок и колебаний, при этом сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

1.0М контекст·1,59 ₽ за запрос

Google: Gemini 3.5 Flash Lite

Gemini 3.5 Flash-Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в рамках сложных многоагентных рабочих процессов.

1.0М контекст·1,59 ₽ за запрос