hubris

OpenAI: GPT-4.1 Nano (batch)

openai/gpt-4.1-nano:batch
openai
Выпущена 14 апреля 2025 г.|1.0М контекст|5,74 ₽/М вход|22,94 ₽/М выход

Для задач, требующих низкой задержки, GPT-4.1 nano является самой быстрой и экономичной моделью в серии GPT-4.1. Она обеспечивает исключительную производительность при небольшом размере благодаря контекстному окну в 1 миллион токенов и набирает 80,1% по MMLU, 50,3% по GPQA и 9,8% по многоязычному кодированию Aider — даже выше, чем GPT-4o mini. Она идеально подходит для таких задач, как классификация или автозаполнение.

Провайдер для OpenAI: GPT-4.1 Nano (batch)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
1.0М
токенов
Макс. ответ
33К
токенов
Вход
5,74 ₽
за 1М токенов
Выход
22,94 ₽
за 1М токенов
Кеш чтение
1,43 ₽
за 1М токенов

Модальности

Вход:ИзображенияТекстФайлыВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

OpenAI
5,74 ₽22,94 ₽1,43 ₽

Поддерживаемые параметры

max_tokensresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_p

Другие модели от openai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 11,47 ₽/М

OpenAI: GPT-4o-mini

GPT-4o mini — это новейшая модель OpenAI после [GPT-4 Omni](/models/openai/gpt-4o), поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными. Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем [GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo). Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной. GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на [общих таблицах лидеров](https://arena.lmsys.org/). Ознакомьтесь с [анонсом запуска](https://openai.com/index/gpt-4o-mini-advancing-cost-efficient-intelligence/), чтобы узнать больше. #multimodal

128К контекст·от 17,21 ₽/М

OpenAI: GPT Transcribe

GPT Transcribe — это высокоточная модель преобразования речи в текст от OpenAI. Она подходит для записанного аудио, потоковой транскрипции файлов и зафиксированных сеансов в реальном времени, с контекстом в свободной форме, подсказками по ключевым словам и поддержкой нескольких языков...

контекст·0,520 ₽ за минуту

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 11,47 ₽/М

OpenAI: GPT-5.6 Luna Pro (batch)

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 11,47 ₽/М

OpenAI: GPT-5.6 Luna (batch)

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая адекватные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 11,47 ₽/М