hubris

OpenAI: Text Embedding 3 Large

openai/text-embedding-3-large
openai
Выпущена 30 октября 2025 г.| контекст|16,43 ₽/М вход|по тарифу · выход

text-embedding-3-large — это самая мощная модель встраивания OpenAI для задач как на английском, так и на других языках. Встраивания (embeddings) — это числовое представление текста, которое можно использовать для измерения связанности между двумя фрагментами текста. Встраивания полезны для поиска, кластеризации, рекомендаций, обнаружения аномалий и задач классификации.

Провайдер для OpenAI: Text Embedding 3 Large

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

openai
Контекст
токенов
Макс. ответ
Вход
16,43 ₽
за 1М токенов
Выход
0 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Эмбеддинги

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
28,58 ₽
по запросам за 30 дней · за 1 млн токенов
OpenAI
16,43 ₽0 т/с100,0 %99,3 %
Azure
16,43 ₽0 т/с100,0 %0,7 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokenspresence_penaltyresponse_formatseedstopstructured_outputstemperaturetop_logprobstop_p

Другие модели от openai

OpenAI: GPT-5.6 Luna

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая достаточные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 25,27 ₽/М

OpenAI: GPT-4o-mini

GPT-4o mini — это новейшая модель OpenAI после [GPT-4 Omni](/models/openai/gpt-4o), поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными. Будучи самой передовой малой моделью, она во много раз доступнее, чем другие недавние передовые модели, и более чем на 60% дешевле, чем [GPT-3.5 Turbo](/models/openai/gpt-3.5-turbo). Она сохраняет интеллект уровня SOTA, будучи при этом значительно более экономичной. GPT-4o mini достигает 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в рейтингах предпочтений чатов на [общих таблицах лидеров](https://arena.lmsys.org/). Ознакомьтесь с [анонсом запуска](https://openai.com/index/gpt-4o-mini-advancing-cost-efficient-intelligence/), чтобы узнать больше. #multimodal

128К контекст·от 18,95 ₽/М

OpenAI: GPT Transcribe

GPT Transcribe — это высокоточная модель преобразования речи в текст от OpenAI. Она подходит для записанного аудио, потоковой транскрипции файлов и зафиксированных сеансов в реальном времени, с контекстом в свободной форме, подсказками по ключевым словам и поддержкой нескольких языков...

контекст·0,570 ₽ за минуту

OpenAI: GPT-5.6 Luna Pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи.

1.1М контекст·от 25,27 ₽/М

OpenAI: GPT-5.6 Luna Pro (batch)

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, но с параметром `reasoning.mode`, установленным на `pro` для получения более качественных ответов на сложные задачи. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

1.1М контекст·от 12,64 ₽/М

OpenAI: GPT-5.6 Luna (batch)

GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для высоконагруженных задач, чувствительных к задержкам, таких как чат, классификация и облегченные агентные рабочие процессы, обеспечивая адекватные возможности рассуждения для своего ценового сегмента.

1.1М контекст·от 12,64 ₽/М