gpt-oss-20b — это открытая модель с 21 миллиардом параметров, выпущенная OpenAI по лицензии Apache 2.0. Она использует архитектуру Mixture-of-Experts (MoE) с 3,6 миллиарда активных параметров на один прямой проход, оптимизированную для инференса с низкой задержкой и развертывания на потребительском или однопроцессорном оборудовании. Модель обучена в формате ответа Harmony от OpenAI и поддерживает настройку уровня рассуждений, fine-tuning и агентские возможности, включая вызов функций, использование инструментов и структурированные выводы.
Провайдер для OpenAI: gpt-oss-20b
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Darkbloom | 2,52 ₽ | 12,62 ₽ | — | 32 т/с | 99,2 % | 1,2 % |
AkashML | 2,52 ₽ | 12,62 ₽ | — | 27 т/с | 99,9 % | 8,4 % |
DekaLLM | 3,66 ₽ | 17,67 ₽ | — | — | 99,8 % | < 0,1 % |
CoreWeave | 3,79 ₽ | 16,41 ₽ | 3,79 ₽ | 198 т/с | 100,0 % | 13,3 % |
DeepInfra | 3,79 ₽ | 17,67 ₽ | — | 100 т/с | 99,9 % | 19,6 % |
Parasail | 3,79 ₽ | 18,94 ₽ | 2,52 ₽ | 81 т/с | 99,8 % | 42,8 % |
Novita | 5,05 ₽ | 18,94 ₽ | — | 118 т/с | 99,8 % | 5,0 % |
SiliconFlow | 5,05 ₽ | 22,72 ₽ | — | — | 97,7 % | < 0,1 % |
Together | 6,31 ₽ | 25,25 ₽ | — | — | — | < 0,1 % |
Amazon Bedrock | 8,84 ₽ | 18,94 ₽ | — | — | 100,0 % | < 0,1 % |
Amazon Bedrock | 8,84 ₽ | 18,94 ₽ | — | — | 98,4 % | < 0,1 % |
Google | 8,84 ₽ | 31,56 ₽ | — | 216 т/с | 99,7 % | 3,9 % |
Groq | 9,47 ₽ | 37,87 ₽ | 4,73 ₽ | — | 99,8 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от openai
OpenAI: GPT-5.6 Luna
GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.
OpenAI: GPT-5.4 Image 2
Image 2 сочетает модель GPT-5.4 от OpenAI с передовыми возможностями генерации изображений от GPT Image 2. Это обеспечивает богатые мультимодальные рабочие процессы, позволяя пользователям беспрепятственно переходить между рассуждениями, кодированием и визуальной генерацией в рамках одного взаимодействия.
OpenAI: GPT-5.6 Terra
GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.
OpenAI: GPT-6 Astra Pro
GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode
OpenAI: GPT-5.6 Luna Pro
GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.
OpenAI: GPT-5.6 Sol
GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.