gpt-oss-20b — это открытая модель с 21 миллиардом параметров, выпущенная OpenAI по лицензии Apache 2.0. Она использует архитектуру Mixture-of-Experts (MoE) с 3,6 миллиарда активных параметров на один прямой проход, оптимизированную для инференса с низкой задержкой и развертывания на потребительском или однопроцессорном оборудовании. Модель обучена в формате ответа Harmony от OpenAI и поддерживает настройку уровня рассуждений, fine-tuning и агентские возможности, включая вызов функций, использование инструментов и структурированные выводы.
Провайдер для OpenAI: gpt-oss-20b
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
CoreWeave | 3,39 ₽ | 14,68 ₽ | 3,39 ₽ | — | 97,2 % | < 0,1 % |
DeepInfra | 3,39 ₽ | 15,81 ₽ | — | 84 т/с | 99,7 % | 21,4 % |
Parasail | 3,39 ₽ | 16,94 ₽ | 2,26 ₽ | 63 т/с | 81,6 % | 11,1 % |
Novita | 4,52 ₽ | 16,94 ₽ | — | 45 т/с | 89,0 % | 4,7 % |
Phala | 4,52 ₽ | 16,94 ₽ | — | 48 т/с | 95,3 % | 6,2 % |
SiliconFlow | 4,52 ₽ | 20,33 ₽ | — | 31 т/с | 94,5 % | 8,5 % |
Together | 5,65 ₽ | 22,59 ₽ | — | — | 96,8 % | < 0,1 % |
Amazon Bedrock | 7,91 ₽ | 16,94 ₽ | — | 161 т/с | — | 7,0 % |
Amazon Bedrock | 7,91 ₽ | 16,94 ₽ | — | 161 т/с | 98,7 % | 7,0 % |
Google | 7,91 ₽ | 28,24 ₽ | — | — | 82,8 % | < 0,1 % |
Fireworks | 7,91 ₽ | 33,89 ₽ | 3,95 ₽ | — | 43,3 % | < 0,1 % |
Groq | 8,47 ₽ | 33,89 ₽ | 4,24 ₽ | — | 99,3 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Другие модели от openai
OpenAI: GPT-5.6 Luna Pro
GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.
OpenAI: GPT-5.6 Luna
GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.
OpenAI: GPT-5.6 Terra Pro
GPT-5.6 Terra Pro — это та же ба
OpenAI: GPT-5.6 Terra
GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.
OpenAI: GPT-5.6 Sol Pro
GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.
OpenAI: GPT-5.6 Sol
GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.