hubris

OpenAI: gpt-oss-20b

openai/gpt-oss-20b
openai
Выпущена 5 августа 2025 г.|131К контекст|3,39 ₽/М вход|14,68 ₽/М выход

gpt-oss-20b — это открытая модель с 21 миллиардом параметров, выпущенная OpenAI по лицензии Apache 2.0. Она использует архитектуру Mixture-of-Experts (MoE) с 3,6 миллиарда активных параметров на один прямой проход, оптимизированную для инференса с низкой задержкой и развертывания на потребительском или однопроцессорном оборудовании. Модель обучена в формате ответа Harmony от OpenAI и поддерживает настройку уровня рассуждений, fine-tuning и агентские возможности, включая вызов функций, использование инструментов и структурированные выводы.

Провайдер для OpenAI: gpt-oss-20b

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
131К
токенов
Макс. ответ
131К
токенов
Вход
3,39 ₽
за 1М токенов
Выход
14,68 ₽
за 1М токенов
Кеш чтение
3,39 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
7,13 ₽
по запросам за 30 дней · за 1 млн токенов
CoreWeave
3,39 ₽14,68 ₽3,39 ₽97,2 %< 0,1 %
DeepInfra
3,39 ₽15,81 ₽84 т/с99,7 %21,4 %
Parasail
3,39 ₽16,94 ₽2,26 ₽63 т/с81,6 %11,1 %
Novita
4,52 ₽16,94 ₽45 т/с89,0 %4,7 %
Phala
4,52 ₽16,94 ₽48 т/с95,3 %6,2 %
SiliconFlow
4,52 ₽20,33 ₽31 т/с94,5 %8,5 %
Together
5,65 ₽22,59 ₽96,8 %< 0,1 %
Amazon Bedrock
7,91 ₽16,94 ₽161 т/с7,0 %
Amazon Bedrock
7,91 ₽16,94 ₽161 т/с98,7 %7,0 %
Google
7,91 ₽28,24 ₽82,8 %< 0,1 %
Fireworks
7,91 ₽33,89 ₽3,95 ₽43,3 %< 0,1 %
Groq
8,47 ₽33,89 ₽4,24 ₽99,3 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от openai

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 11,30 ₽/М

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 11,30 ₽/М

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro — это та же ба

1.1М контекст·от 112,96 ₽/М

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.

1.1М контекст·от 112,96 ₽/М

OpenAI: GPT-5.6 Sol Pro

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 564,79 ₽/М

OpenAI: GPT-5.6 Sol

GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.

1.1М контекст·от 564,79 ₽/М