Нативная визуально-языковая модель Qwen3.5 серии 397B-A17B построена на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью mixture-of-experts, достигая более высокой эффективности инференса. Она демонстрирует передовую производительность, сопоставимую с ведущими моделями, в широком спектре задач, включая понимание языка, логическое рассуждение, генерацию кода, агентские задачи, понимание изображений, понимание видео и взаимодействие с графическим пользовательским интерфейсом (GUI). Благодаря своим надёжным возможностям генерации кода и агентским возможностям, модель демонстрирует сильную обобщаемость в различных агентах.
Провайдер для Qwen: Qwen3.5 397B A17B
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
DigitalOcean | 43,49 ₽ | 276,75 ₽ | 12,54 ₽ | — | 98,1 % |
Alibaba | 44,05 ₽ | 264,32 ₽ | — | — | 99,7 % |
Chutes | 50,83 ₽ | 338,88 ₽ | 25,42 ₽ | — | 99,1 % |
DeepInfra | 50,83 ₽ | 338,88 ₽ | 24,85 ₽ | — | 98,4 % |
Parasail | 56,48 ₽ | 406,65 ₽ | 33,89 ₽ | — | 98,8 % |
AtlasCloud | 62,13 ₽ | 395,36 ₽ | 62,13 ₽ | — | 93,9 % |
Phala | 62,13 ₽ | 395,36 ₽ | 25,42 ₽ | — | 98,8 % |
Novita | 67,78 ₽ | 406,65 ₽ | — | — | 97,8 % |
StreamLake | 67,78 ₽ | 406,65 ₽ | 13,56 ₽ | — | 98,6 % |
GMICloud | 67,78 ₽ | 406,65 ₽ | — | — | 0,0 % |
Venice | 84,72 ₽ | 508,31 ₽ | — | — | 96,8 % |
Поддерживаемые параметры
Другие модели от qwen
Qwen: Qwen3.7 Flash
Qwen3.7 Flash — это модель визуально-языкового рассуждения от Alibaba. Она подходит для мультимодальных агентов, визуального кодирования, поиска и компьютерного взаимодействия, обладая сильными сторонами в распознавании объектов, пространственном понимании и восприятии реального мира.
Qwen: Qwen-Audio-3.0-TTS Plus
Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
Qwen: Qwen-Audio-3.0-TTS Flash
Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
Qwen: Qwen3.7 Plus
Qwen3.7-Plus — это экономичная модель из серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений с текстовым выводом, развивая текстовые возможности серии с комплексным обновлением её визуально-языковых способностей, сохраняя при этом полнофункциональный интеллект агентского уровня для кодирования, использования инструментов и рабочих процессов повышения производительности. Её отличительной чертой является мультимодальная интерактивная гибридная агентская способность: она может воспринимать реальные сцены, читать экраны и взаимодействовать с графическими интерфейсами, генерировать код по визуальным ссылкам и выполнять сквозную навигацию в мобильных приложениях.
Qwen: Qwen3.7 Max
Qwen3.7-Max — это флагманская модель в серии Qwen3.7 от Alibaba. Она поддерживает ввод и вывод текста и разработана для рабочих нагрузок, ориентированных на агентов, с особыми преимуществами в кодировании, офисных и продуктивных задачах, а также в автономном выполнении с длительным горизонтом. Модель предлагает заметные улучшения в кодировании и агентском исполнении по сравнению с предыдущими поколениями Qwen и поддерживает явное кэширование prompt для эффективного повторного использования контекста.
Qwen: Qwen3 ASR Flash
Qwen3-ASR-Flash — это сервис автоматического распознавания речи от Alibaba, построенный на основе Qwen3-Omni и обученный на десятках миллионов часов мультимодальных речевых данных. Модель поддерживает 11 языков —...