hubris
Логотип Qwen — провайдер модели Qwen: Qwen3.8 Max Prime

Qwen: Qwen3.8 Max Prime

qwen/qwen3.8-max-prime
qwen
Выпущена 23 сентября 2026 г.|1.0М контекст|504,95 ₽/М вход|1 514,84 ₽/М выход

Qwen3.8 Max Prime — это вариант Qwen3.8 Max с более высокой пропускной способностью от команды Qwen из Alibaba, предлагаемый как отдельный SKU по более высокой цене. Он принимает текстовые, графические и видеовходы и возвращает текст, имеет контекстное окно в 1M токенов и по умолчанию включает рассуждения. Поддерживаются вызов инструментов, структурированные выводы и настраиваемое усилие рассуждения, что соответствует Qwen3.8 Max.

Провайдер для Qwen: Qwen3.8 Max Prime

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
1.0М
токенов
Макс. ответ
131К
токенов
Вход
504,95 ₽
за 1М токенов
Выход
1 514,84 ₽
за 1М токенов
Кеш чтение
63,12 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Alibaba
504,95 ₽1 514,84 ₽63,12 ₽—99,8 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.

1.0М контекст·от 18,94 ₽/М

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash — это омнимодальная модель рассуждений от Alibaba, первая модель Qwen, построенная на основе агентских возможностей с нативным пониманием аудио и видео. Она подходит для анализа и обобщения аудио и видео, рабочих процессов редактирования и производства видео, аудио-видео диалогов, кодирования, работы со знаниями и взаимодействия с графическим интерфейсом, и особенно сильна в долгосрочных мультимедийных задачах, которые сочетают речь, звук и визуальный контекст. Она также поддерживает понимание двухканального и четырехканального пространственного аудио.

1.0М контекст·от 18,94 ₽/М

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.

1.0М контекст·от 252,47 ₽/М

Qwen: Qwen3.8 27B (free)

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

262К контекст·бесплатно

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 53,02 ₽/М

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

— контекст·0,010 ₽ за секунду