hubris

OpenAI: GPT-4o-mini

openai/gpt-4o-mini
openai
Выпущена 18 июля 2024 г.|128К контекст|16,94 ₽/М вход|67,78 ₽/М выход

GPT-4o mini — это новейшая модель OpenAI после GPT-4 Omni, поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными.

Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем GPT-3.5 Turbo. Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной.

GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на общих таблицах лидеров.

Ознакомьтесь с анонсом запуска, чтобы узнать больше.

#multimodal

Провайдер для OpenAI: GPT-4o-mini

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
128К
токенов
Макс. ответ
16К
токенов
Вход
16,94 ₽
за 1М токенов
Выход
67,78 ₽
за 1М токенов
Кеш чтение
8,47 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияФайлыВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
23,14 ₽
по запросам за 30 дней · за 1 млн токенов
Azure
16,94 ₽67,78 ₽8,47 ₽48 т/с100,0 %49,0 %
OpenAI
16,94 ₽67,78 ₽8,47 ₽51 т/с100,0 %51,0 %
Azure
18,64 ₽74,55 ₽9,32 ₽48 т/с100,0 %49,0 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokenspredictionpresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options

Другие модели от openai

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 11,30 ₽/М

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 11,30 ₽/М

OpenAI: GPT-5.6 Terra Pro

GPT-5.6 Terra Pro — это та же ба

1.1М контекст·от 112,96 ₽/М

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.

1.1М контекст·от 112,96 ₽/М

OpenAI: GPT-5.6 Sol Pro

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 564,79 ₽/М

OpenAI: GPT-5.6 Sol

GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.

1.1М контекст·от 564,79 ₽/М