Qwen Image 3 Pro — это модель для генерации и редактирования изображений от Qwen. Она поддерживает точный рендеринг текста и деталей размером до 10 пикселей, а также обладает более обширными мировыми знаниями...
Провайдер для Qwen: Qwen Image 3 Pro
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Поддерживаемые параметры
Другие модели от qwen
Qwen: Qwen Image 3
Qwen Image 3 — это унифицированная модель генерации и редактирования изображений от Qwen. Она поддерживает точный рендеринг текста и деталей размером до 10 пикселей, а также более богатый мир...
Qwen: Qwen3.8 Max
Qwen3.8 Max — это флагманская модель в серии Qwen3.8 от Alibaba, общедоступный преемник Qwen3.8 Max Preview. Это мультимодальная модель рассуждений, предназначенная для сложных рассуждений, визуального понимания, кодирования и агентских рабочих процессов.
Qwen: Qwen3.7 Flash
Qwen3.7 Flash — это модель визуально-языкового рассуждения от Alibaba. Она подходит для мультимодальных агентов, визуального кодирования, поиска и компьютерного взаимодействия, обладая сильными сторонами в распознавании объектов, пространственном понимании и восприятии реального мира.
Qwen: Qwen-Audio-3.0-TTS Plus
Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
Qwen: Qwen-Audio-3.0-TTS Flash
Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
Qwen: Qwen3.7 Plus
Qwen3.7-Plus — это экономичная модель из серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений с текстовым выводом, развивая текстовые возможности серии с комплексным обновлением её визуально-языковых способностей, сохраняя при этом полнофункциональный интеллект агентского уровня для кодирования, использования инструментов и рабочих процессов повышения производительности. Её отличительной чертой является мультимодальная интерактивная гибридная агентская способность: она может воспринимать реальные сцены, читать экраны и взаимодействовать с графическими интерфейсами, генерировать код по визуальным ссылкам и выполнять сквозную навигацию в мобильных приложениях.