hubris
Логотип Qwen — провайдер модели Qwen: Qwen3.5 397B A17B

Qwen: Qwen3.5 397B A17B

qwen/qwen3.5-397b-a17b
qwen
Выпущена 16 февраля 2026 г.|262К контекст|69,50 ₽/М вход|442,26 ₽/М выход

Нативная визуально-языковая модель Qwen3.5 серии 397B-A17B построена на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью mixture-of-experts, достигая более высокой эффективности инференса. Она демонстрирует передовую производительность, сопоставимую с ведущими моделями, в широком спектре задач, включая понимание языка, логическое рассуждение, генерацию кода, агентские задачи, понимание изображений, понимание видео и взаимодействие с графическим пользовательским интерфейсом (GUI). Благодаря своим надёжным возможностям генерации кода и агентским возможностям, модель демонстрирует сильную обобщаемость в различных агентах.

Провайдер для Qwen: Qwen3.5 397B A17B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
69,50 ₽
за 1М токенов
Выход
442,26 ₽
за 1М токенов
Кеш чтение
28,43 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Alibaba
49,28 ₽295,68 ₽99,9 %
DeepInfra
56,86 ₽379,08 ₽27,80 ₽91,9 %
Parasail
63,18 ₽454,90 ₽37,91 ₽99,1 %
DigitalOcean
69,50 ₽442,26 ₽14,03 ₽97,1 %
Phala
69,50 ₽442,26 ₽28,43 ₽98,8 %
AtlasCloud
69,50 ₽442,26 ₽69,50 ₽96,8 %
StreamLake
75,82 ₽454,90 ₽15,16 ₽97,6 %
GMICloud
75,82 ₽454,90 ₽63,5 %
Novita
75,82 ₽454,90 ₽98,3 %
Venice
94,77 ₽568,62 ₽97,3 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.

1.0М контекст·от 252,72 ₽/М

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.

1.0М контекст·от 18,95 ₽/М

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 53,07 ₽/М

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

контекст·0,010 ₽ за секунду

Qwen: Qwen3 ASR 0.6B

Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...

контекст·0,010 ₽ за секунду

Qwen: Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B — это открытая разреженная модель MoE от Qwen, являющаяся открытым вариантом Qwen3.8 Max, с 95 миллиардами активных параметров из 2,4 триллионов общих. Она подходит для кодирования, исследований, сложного рассуждения и агентских рабочих процессов.

1.0М контекст·от 252,72 ₽/М