hubris
Логотип Qwen — провайдер модели Qwen: Qwen3.5 397B A17B

Qwen: Qwen3.5 397B A17B

qwen/qwen3.5-397b-a17b
qwen
Выпущена 16 февраля 2026 г.|262К контекст|44,05 ₽/М вход|264,32 ₽/М выход

Нативная визуально-языковая модель Qwen3.5 серии 397B-A17B построена на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью mixture-of-experts, достигая более высокой эффективности инференса. Она демонстрирует передовую производительность, сопоставимую с ведущими моделями, в широком спектре задач, включая понимание языка, логическое рассуждение, генерацию кода, агентские задачи, понимание изображений, понимание видео и взаимодействие с графическим пользовательским интерфейсом (GUI). Благодаря своим надёжным возможностям генерации кода и агентским возможностям, модель демонстрирует сильную обобщаемость в различных агентах.

Провайдер для Qwen: Qwen3.5 397B A17B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
262К
токенов
Макс. ответ
66К
токенов
Вход
44,05 ₽
за 1М токенов
Выход
264,32 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DigitalOcean
43,49 ₽276,75 ₽12,54 ₽98,1 %
Alibaba
44,05 ₽264,32 ₽99,7 %
Chutes
50,83 ₽338,88 ₽25,42 ₽99,1 %
DeepInfra
50,83 ₽338,88 ₽24,85 ₽98,4 %
Parasail
56,48 ₽406,65 ₽33,89 ₽98,8 %
AtlasCloud
62,13 ₽395,36 ₽62,13 ₽93,9 %
Phala
62,13 ₽395,36 ₽25,42 ₽98,8 %
Novita
67,78 ₽406,65 ₽97,8 %
StreamLake
67,78 ₽406,65 ₽13,56 ₽98,6 %
GMICloud
67,78 ₽406,65 ₽0,0 %
Venice
84,72 ₽508,31 ₽96,8 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.7 Flash

Qwen3.7 Flash — это модель визуально-языкового рассуждения от Alibaba. Она подходит для мультимодальных агентов, визуального кодирования, поиска и компьютерного взаимодействия, обладая сильными сторонами в распознавании объектов, пространственном понимании и восприятии реального мира.

1.0М контекст·от 3,39 ₽/М

Qwen: Qwen-Audio-3.0-TTS Plus

Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

контекст·2 259,18 ₽ за 1М символов

Qwen: Qwen-Audio-3.0-TTS Flash

Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

контекст·1 694,39 ₽ за 1М символов

Qwen: Qwen3.7 Plus

Qwen3.7-Plus — это экономичная модель из серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений с текстовым выводом, развивая текстовые возможности серии с комплексным обновлением её визуально-языковых способностей, сохраняя при этом полнофункциональный интеллект агентского уровня для кодирования, использования инструментов и рабочих процессов повышения производительности. Её отличительной чертой является мультимодальная интерактивная гибридная агентская способность: она может воспринимать реальные сцены, читать экраны и взаимодействовать с графическими интерфейсами, генерировать код по визуальным ссылкам и выполнять сквозную навигацию в мобильных приложениях.

1.0М контекст·от 36,15 ₽/М

Qwen: Qwen3.7 Max

Qwen3.7-Max — это флагманская модель в серии Qwen3.7 от Alibaba. Она поддерживает ввод и вывод текста и разработана для рабочих нагрузок, ориентированных на агентов, с особыми преимуществами в кодировании, офисных и продуктивных задачах, а также в автономном выполнении с длительным горизонтом. Модель предлагает заметные улучшения в кодировании и агентском исполнении по сравнению с предыдущими поколениями Qwen и поддерживает явное кэширование prompt для эффективного повторного использования контекста.

1.0М контекст·от 166,61 ₽/М

Qwen: Qwen3 ASR Flash

Qwen3-ASR-Flash — это сервис автоматического распознавания речи от Alibaba, построенный на основе Qwen3-Omni и обученный на десятках миллионов часов мультимодальных речевых данных. Модель поддерживает 11 языков —...

контекст·0,010 ₽ за секунду