hubris
Логотип Qwen — провайдер модели Qwen: Qwen3 Embedding 8B

Qwen: Qwen3 Embedding 8B

qwen/qwen3-embedding-8b
qwen
Выпущена 28 октября 2025 г.|33К контекст|1,26 ₽/М вход|по тарифу · выход

Серия моделей Qwen3 Embedding — это новейшая проприетарная модель семейства Qwen, специально разработанная для задач встраивания и ранжирования текста. Эта серия унаследовала исключительные многоязычные возможности, понимание длинных текстов и навыки рассуждения своей базовой модели. Серия Qwen3 Embedding представляет собой значительные достижения в нескольких задачах встраивания и ранжирования текста, включая поиск текста, поиск кода, классификацию текста, кластеризацию текста и битекстовый майнинг.

Провайдер для Qwen: Qwen3 Embedding 8B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
33К
токенов
Макс. ответ
32К
токенов
Вход
1,26 ₽
за 1М токенов
Выход
0 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Эмбеддинги

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Nebius
1,26 ₽100,0 %
DeepInfra
1,26 ₽100,0 %
SiliconFlow
5,05 ₽100,0 %

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstoptemperaturetop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 50,54 ₽/М

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

контекст·0,010 ₽ за секунду

Qwen: Qwen3 ASR 0.6B

Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...

контекст·0,010 ₽ за секунду

Qwen: Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B — это открытая разреженная модель MoE от Qwen, являющаяся открытым вариантом Qwen3.8 Max, с 95 миллиардами активных параметров из 2,4 триллионов общих. Она подходит для кодирования, исследований, сложного рассуждения и агентских рабочих процессов.

1.0М контекст·от 252,72 ₽/М

Qwen: Qwen Image 3

Qwen Image 3 — это унифицированная модель генерации и редактирования изображений от Qwen. Она поддерживает точный рендеринг текста и деталей размером до 10 пикселей, а также более богатый мир...

контекст·0,540 ₽ за изображение

Qwen: Qwen Image 3 Pro

Qwen Image 3 Pro — это модель для генерации и редактирования изображений от Qwen. Она поддерживает точный рендеринг текста и деталей размером до 10 пикселей, а также обладает более обширными мировыми знаниями...

контекст·0,540 ₽ за изображение