gpt-oss-120b — это открытая языковая модель Mixture-of-Experts (MoE) с 117 миллиардами параметров от OpenAI, разработанная для высокоинтеллектуальных, агентных и универсальных производственных сценариев использования. Она активирует 5,1 миллиарда параметров за один прямой проход и оптимизирована для работы на одном графическом процессоре H100 с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированного вывода.
Провайдер для OpenAI: gpt-oss-120b
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
AkashML | 3,79 ₽ | 21,46 ₽ | 3,79 ₽ | 49 т/с | 99,4 % | 4,4 % |
CoreWeave | 3,79 ₽ | 21,46 ₽ | 3,79 ₽ | 40 т/с | 99,9 % | 6,3 % |
DekaLLM | 3,79 ₽ | 22,72 ₽ | — | — | 99,8 % | < 0,1 % |
DeepInfra | 4,67 ₽ | 21,46 ₽ | — | 36 т/с | 98,4 % | 31,6 % |
Crusoe | 6,31 ₽ | 31,56 ₽ | 6,31 ₽ | — | 99,1 % | < 0,1 % |
Novita | 6,31 ₽ | 31,56 ₽ | — | 63 т/с | 89,1 % | 10,5 % |
Mancer 2 | 6,31 ₽ | 37,87 ₽ | — | 45 т/с | 99,3 % | 7,8 % |
DigitalOcean | 7,57 ₽ | 53,02 ₽ | 1,51 ₽ | — | 100,0 % | < 0,1 % |
Google | 11,36 ₽ | 45,45 ₽ | — | — | 95,1 % | < 0,1 % |
BaseTen | 12,62 ₽ | 63,12 ₽ | 12,62 ₽ | — | 100,0 % | < 0,1 % |
BaseTen | 12,62 ₽ | 63,12 ₽ | 12,62 ₽ | — | 100,0 % | < 0,1 % |
Parasail | 12,62 ₽ | 94,68 ₽ | 6,94 ₽ | — | 100,0 % | < 0,1 % |
SambaNova | 17,67 ₽ | 119,92 ₽ | — | 56 т/с | 97,4 % | 3,9 % |
Amazon Bedrock | 18,94 ₽ | 75,74 ₽ | — | 88 т/с | 100,0 % | 7,0 % |
Nebius | 18,94 ₽ | 75,74 ₽ | — | — | 99,5 % | < 0,1 % |
Amazon Bedrock | 18,94 ₽ | 75,74 ₽ | — | 88 т/с | 98,1 % | 7,0 % |
DeepInfra | 18,94 ₽ | 75,74 ₽ | — | 36 т/с | 100,0 % | 31,6 % |
SiliconFlow | 18,94 ₽ | 75,74 ₽ | 9,47 ₽ | 14 т/с | 92,9 % | 9,7 % |
Phala | 18,94 ₽ | 75,74 ₽ | — | — | 90,9 % | < 0,1 % |
Together | 18,94 ₽ | 75,74 ₽ | — | — | 87,6 % | < 0,1 % |
Groq | 18,94 ₽ | 75,74 ₽ | 9,47 ₽ | — | 100,0 % | < 0,1 % |
Mara | 18,94 ₽ | 94,68 ₽ | — | — | 91,2 % | < 0,1 % |
DeepInfra | 25,25 ₽ | 119,92 ₽ | — | 36 т/с | 64,3 % | 31,6 % |
Cerebras | 44,18 ₽ | 94,68 ₽ | 44,18 ₽ | — | 100,0 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от openai
OpenAI: GPT-5.6 Luna
GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.
OpenAI: GPT-5.4 Image 2
Image 2 сочетает модель GPT-5.4 от OpenAI с передовыми возможностями генерации изображений от GPT Image 2. Это обеспечивает богатые мультимодальные рабочие процессы, позволяя пользователям беспрепятственно переходить между рассуждениями, кодированием и визуальной генерацией в рамках одного взаимодействия.
OpenAI: GPT-5.6 Terra
GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.
OpenAI: GPT-6 Astra Pro
GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode
OpenAI: GPT-5.6 Luna Pro
GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.
OpenAI: GPT-5.6 Sol
GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.