gpt-oss-120b — это открытая языковая модель Mixture-of-Experts (MoE) с 117 миллиардами параметров от OpenAI, разработанная для высокоинтеллектуальных, агентных и универсальных производственных сценариев использования. Она активирует 5,1 миллиарда параметров за один прямой проход и оптимизирована для работы на одном графическом процессоре H100 с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированного вывода.
Провайдер для OpenAI: gpt-oss-120b
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
AkashML | 3,79 ₽ | 21,48 ₽ | 3,79 ₽ | 52 т/с | 99,8 % | 3,9 % |
CoreWeave | 3,79 ₽ | 21,48 ₽ | 3,79 ₽ | 39 т/с | 99,9 % | 6,2 % |
DeepInfra | 4,68 ₽ | 21,48 ₽ | — | 37 т/с | 99,9 % | 33,1 % |
Novita | 6,32 ₽ | 31,59 ₽ | — | 64 т/с | 96,1 % | 10,6 % |
SiliconFlow | 6,32 ₽ | 56,86 ₽ | — | 14 т/с | 90,2 % | 10,5 % |
DigitalOcean | 6,95 ₽ | 48,65 ₽ | 2,53 ₽ | — | 100,0 % | < 0,1 % |
Mancer 2 | 7,58 ₽ | 63,18 ₽ | — | 43 т/с | 99,4 % | 7,5 % |
Google | 11,37 ₽ | 45,49 ₽ | — | — | 91,8 % | < 0,1 % |
BaseTen | 12,64 ₽ | 63,18 ₽ | 12,64 ₽ | — | 100,0 % | < 0,1 % |
BaseTen | 12,64 ₽ | 63,18 ₽ | 12,64 ₽ | — | 100,0 % | < 0,1 % |
Parasail | 12,64 ₽ | 94,77 ₽ | 6,95 ₽ | — | 100,0 % | < 0,1 % |
SambaNova | 17,69 ₽ | 120,04 ₽ | — | 55 т/с | 99,5 % | 4,3 % |
Amazon Bedrock | 18,95 ₽ | 75,82 ₽ | — | 88 т/с | 100,0 % | 7,7 % |
Nebius | 18,95 ₽ | 75,82 ₽ | — | — | 97,9 % | < 0,1 % |
Amazon Bedrock | 18,95 ₽ | 75,82 ₽ | — | 88 т/с | 97,6 % | 7,7 % |
DeepInfra | 18,95 ₽ | 75,82 ₽ | — | 37 т/с | 100,0 % | 33,1 % |
Phala | 18,95 ₽ | 75,82 ₽ | — | — | 97,3 % | < 0,1 % |
Together | 18,95 ₽ | 75,82 ₽ | — | — | 95,2 % | < 0,1 % |
Groq | 18,95 ₽ | 75,82 ₽ | 9,48 ₽ | — | 100,0 % | < 0,1 % |
Mara | 18,95 ₽ | 94,77 ₽ | — | — | 92,8 % | < 0,1 % |
DeepInfra | 25,27 ₽ | 120,04 ₽ | — | 37 т/с | 99,0 % | 33,1 % |
Cerebras | 44,23 ₽ | 94,77 ₽ | 44,23 ₽ | — | 100,0 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от openai
OpenAI: GPT-5.6 Luna
GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.
OpenAI: GPT-4o-mini
GPT-4o mini — это новейшая модель OpenAI после [GPT-4 Omni](/models/openai/gpt-4o), поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными. Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем [GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo). Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной. GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на [общих таблицах лидеров](https://arena.lmsys.org/). Ознакомьтесь с [анонсом запуска](https://openai.com/index/gpt-4o-mini-advancing-cost-efficient-intelligence/), чтобы узнать больше. #multimodal
OpenAI: GPT-6 Astra (batch)
GPT-6 Astra — это флагманская модель OpenAI для сложных сквозных задач. Она подходит для углубленного анализа, разработки программного обеспечения, глубоких исследований, научной работы и создания документов, обладая особыми преимуществами в долгосрочных агентных задачах, связанных с использованием компьютера и браузера.
OpenAI: GPT-6 Astra
GPT-6 Astra — это флагманская модель OpenAI для требовательных сквозных задач. Она подходит для углубленного анализа, разработки программного обеспечения, глубоких исследований, научной работы и создания документов, обладая особыми преимуществами в долгосрочных агентных задачах, связанных с использованием компьютера и браузера.
OpenAI: GPT-6 Astra Pro (batch)
GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode
OpenAI: GPT-6 Astra Pro
GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode