hubris

OpenAI: GPT-4o-mini

openai/gpt-4o-mini
openai
Выпущена 18 июля 2024 г.|128К контекст|18,94 ₽/М вход|75,74 ₽/М выход

GPT-4o mini — это новейшая модель OpenAI после GPT-4 Omni, поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными.

Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем GPT-3.5 Turbo. Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной.

GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на общих таблицах лидеров.

Ознакомьтесь с анонсом запуска, чтобы узнать больше.

#multimodal

Провайдер для OpenAI: GPT-4o-mini

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
128К
токенов
Макс. ответ
16К
токенов
Вход
18,94 ₽
за 1М токенов
Выход
75,74 ₽
за 1М токенов
Кеш чтение
9,47 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияФайлыВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
24,08 ₽
по запросам за 30 дней · за 1 млн токенов
Azure
18,94 ₽75,74 ₽9,47 ₽51 т/с98,3 %47,3 %
OpenAI
18,94 ₽75,74 ₽9,47 ₽76 т/с99,9 %52,7 %
Azure
20,83 ₽83,32 ₽10,41 ₽51 т/с100,0 %47,3 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokenspredictionpresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options

Другие модели от openai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 25,25 ₽/М

OpenAI: GPT-5.4 Image 2

Image 2 сочетает модель GPT-5.4 от OpenAI с передовыми возможностями генерации изображений от GPT Image 2. Это обеспечивает богатые мультимодальные рабочие процессы, позволяя пользователям беспрепятственно переходить между рассуждениями, кодированием и визуальной генерацией в рамках одного взаимодействия.

272К контекст·от 1 009,89 ₽/М

OpenAI: GPT-5.6 Terra

GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач кодирования, рассуждений и агентных задач, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.

1.1М контекст·от 252,47 ₽/М

OpenAI: GPT-6 Astra Pro

GPT-6 Astra Pro — это та же базовая модель, что и GPT-6 Astra, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 1 262,36 ₽/М

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 25,25 ₽/М

OpenAI: GPT-5.6 Sol

GPT-5.6 Sol — это флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложного рассуждения, кодирования и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговом кодировании и долгосрочном решении проблем.

1.1М контекст·от 252,47 ₽/М