hubris

OpenAI: gpt-oss-120b

openai/gpt-oss-120b
openai
Выпущена 5 августа 2025 г.|131К контекст|18,94 ₽/М вход|75,74 ₽/М выход

gpt-oss-120b — это открытая языковая модель Mixture-of-Experts (MoE) с 117 миллиардами параметров от OpenAI, разработанная для высокоинтеллектуальных, агентных и универсальных производственных сценариев использования. Она активирует 5,1 миллиарда параметров за один прямой проход и оптимизирована для работы на одном графическом процессоре H100 с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированного вывода.

Провайдер для OpenAI: gpt-oss-120b

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
131К
токенов
Макс. ответ
66К
токенов
Вход
18,94 ₽
за 1М токенов
Выход
75,74 ₽
за 1М токенов
Кеш чтение
9,47 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
10,24 ₽
по запросам за 30 дней · за 1 млн токенов
AkashML
3,79 ₽21,46 ₽3,79 ₽49 т/с99,4 %4,4 %
CoreWeave
3,79 ₽21,46 ₽3,79 ₽40 т/с99,9 %6,3 %
DekaLLM
3,79 ₽22,72 ₽99,8 %< 0,1 %
DeepInfra
4,67 ₽21,46 ₽36 т/с98,4 %31,6 %
Crusoe
6,31 ₽31,56 ₽6,31 ₽99,1 %< 0,1 %
Novita
6,31 ₽31,56 ₽63 т/с89,1 %10,5 %
Mancer 2
6,31 ₽37,87 ₽45 т/с99,3 %7,8 %
DigitalOcean
7,57 ₽53,02 ₽1,51 ₽100,0 %< 0,1 %
Google
11,36 ₽45,45 ₽95,1 %< 0,1 %
BaseTen
12,62 ₽63,12 ₽12,62 ₽100,0 %< 0,1 %
BaseTen
12,62 ₽63,12 ₽12,62 ₽100,0 %< 0,1 %
Parasail
12,62 ₽94,68 ₽6,94 ₽100,0 %< 0,1 %
SambaNova
17,67 ₽119,92 ₽56 т/с97,4 %3,9 %
Amazon Bedrock
18,94 ₽75,74 ₽88 т/с100,0 %7,0 %
Nebius
18,94 ₽75,74 ₽99,5 %< 0,1 %
Amazon Bedrock
18,94 ₽75,74 ₽88 т/с98,1 %7,0 %
DeepInfra
18,94 ₽75,74 ₽36 т/с100,0 %31,6 %
SiliconFlow
18,94 ₽75,74 ₽9,47 ₽14 т/с92,9 %9,7 %
Phala
18,94 ₽75,74 ₽90,9 %< 0,1 %
Together
18,94 ₽75,74 ₽87,6 %< 0,1 %
Groq
18,94 ₽75,74 ₽9,47 ₽100,0 %< 0,1 %
Mara
18,94 ₽94,68 ₽91,2 %< 0,1 %
DeepInfra
25,25 ₽119,92 ₽36 т/с64,3 %31,6 %
Cerebras
44,18 ₽94,68 ₽44,18 ₽100,0 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

Другие модели от openai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 25,25 ₽/М

OpenAI: GPT-5.4 Image 2

Image 2 сочетает модель GPT-5.4 от OpenAI с передовыми возможностями генерации изображений от GPT Image 2. Это обеспечивает богатые мультимодальные рабочие процессы, позволяя пользователям беспрепятственно переходить между рассуждениями, кодированием и визуальной генерацией в рамках одного взаимодействия.

272К контекст·от 1 009,89 ₽/М

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.

1.1М контекст·от 252,47 ₽/М

OpenAI: GPT-6 Astra Pro

GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 1 262,36 ₽/М

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 25,25 ₽/М

OpenAI: GPT-5.6 Sol

GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.

1.1М контекст·от 252,47 ₽/М