hubris

OpenAI: gpt-oss-120b

openai/gpt-oss-120b
openai
Выпущена 5 августа 2025 г.|131К контекст|4,68 ₽/М вход|21,48 ₽/М выход

gpt-oss-120b — это открытая языковая модель Mixture-of-Experts (MoE) с 117 миллиардами параметров от OpenAI, разработанная для высокоинтеллектуальных, агентных и универсальных производственных сценариев использования. Она активирует 5,1 миллиарда параметров за один прямой проход и оптимизирована для работы на одном графическом процессоре H100 с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированного вывода.

Провайдер для OpenAI: gpt-oss-120b

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
131К
токенов
Макс. ответ
118К
токенов
Вход
4,68 ₽
за 1М токенов
Выход
21,48 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
10,42 ₽
по запросам за 30 дней · за 1 млн токенов
AkashML
3,79 ₽21,48 ₽3,79 ₽52 т/с99,8 %3,9 %
CoreWeave
3,79 ₽21,48 ₽3,79 ₽39 т/с99,9 %6,2 %
DeepInfra
4,68 ₽21,48 ₽37 т/с99,9 %33,1 %
Novita
6,32 ₽31,59 ₽64 т/с96,1 %10,6 %
SiliconFlow
6,32 ₽56,86 ₽14 т/с90,2 %10,5 %
DigitalOcean
6,95 ₽48,65 ₽2,53 ₽100,0 %< 0,1 %
Mancer 2
7,58 ₽63,18 ₽43 т/с99,4 %7,5 %
Google
11,37 ₽45,49 ₽91,8 %< 0,1 %
BaseTen
12,64 ₽63,18 ₽12,64 ₽100,0 %< 0,1 %
BaseTen
12,64 ₽63,18 ₽12,64 ₽100,0 %< 0,1 %
Parasail
12,64 ₽94,77 ₽6,95 ₽100,0 %< 0,1 %
SambaNova
17,69 ₽120,04 ₽55 т/с99,5 %4,3 %
Amazon Bedrock
18,95 ₽75,82 ₽88 т/с100,0 %7,7 %
Nebius
18,95 ₽75,82 ₽97,9 %< 0,1 %
Amazon Bedrock
18,95 ₽75,82 ₽88 т/с97,6 %7,7 %
DeepInfra
18,95 ₽75,82 ₽37 т/с100,0 %33,1 %
Phala
18,95 ₽75,82 ₽97,3 %< 0,1 %
Together
18,95 ₽75,82 ₽95,2 %< 0,1 %
Groq
18,95 ₽75,82 ₽9,48 ₽100,0 %< 0,1 %
Mara
18,95 ₽94,77 ₽92,8 %< 0,1 %
DeepInfra
25,27 ₽120,04 ₽37 т/с99,0 %33,1 %
Cerebras
44,23 ₽94,77 ₽44,23 ₽100,0 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

Другие модели от openai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 25,27 ₽/М

OpenAI: GPT-4o-mini

GPT-4o mini — это новейшая модель OpenAI после [GPT-4 Omni](/models/openai/gpt-4o), поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными. Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем [GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo). Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной. GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на [общих таблицах лидеров](https://arena.lmsys.org/). Ознакомьтесь с [анонсом запуска](https://openai.com/index/gpt-4o-mini-advancing-cost-efficient-intelligence/), чтобы узнать больше. #multimodal

128К контекст·от 18,95 ₽/М

OpenAI: GPT-6 Astra (batch)

GPT-6 Astra — это флагманская модель OpenAI для сложных сквозных задач. Она подходит для углубленного анализа, разработки программного обеспечения, глубоких исследований, научной работы и создания документов, обладая особыми преимуществами в долгосрочных агентных задачах, связанных с использованием компьютера и браузера.

1.1М контекст·от 631,80 ₽/М

OpenAI: GPT-6 Astra

GPT-6 Astra — это флагманская модель OpenAI для требовательных сквозных задач. Она подходит для углубленного анализа, разработки программного обеспечения, глубоких исследований, научной работы и создания документов, обладая особыми преимуществами в долгосрочных агентных задачах, связанных с использованием компьютера и браузера.

1.1М контекст·от 1 263,61 ₽/М

OpenAI: GPT-6 Astra Pro (batch)

GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 631,80 ₽/М

OpenAI: GPT-6 Astra Pro

GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 1 263,61 ₽/М