hubris
Логотип Qwen — провайдер модели Qwen: Qwen-Audio-3.0-TTS Flash

Qwen: Qwen-Audio-3.0-TTS Flash

qwen/qwen-audio-3.0-tts-flash
qwen
Выпущена 23 июля 2026 г.|1 893,55 ₽ за 1М символов

Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

Провайдер для Qwen: Qwen-Audio-3.0-TTS Flash

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
токенов
Макс. ответ
Characters
1 893,55 ₽
за 1М символов

Модальности

Вход:ТекстВыход:Озвучка

Голоса

Голос выбирается параметром voice — он обязателен. Всего 2 голоса; подставьте идентификатор целиком, как он написан.

loongjohnlonganhuan_v3.6

Поддерживаемые параметры

max_tokenspresence_penaltyresponse_formatseedtemperaturetop_p

Другие модели от qwen

Qwen: Qwen3 Coder 480B A35B

Qwen3-Coder-480B-A35B-Instruct — это модель генерации кода Mixture-of-Experts (MoE), разработанная командой Qwen. Она оптимизирована для агентских задач кодирования, таких как вызов функций, использование инструментов и рассуждения в длинном контексте по репозиториям. Модель имеет 480 миллиардов общих параметров, из которых 35 миллиардов активны за один прямой проход (8 из 160 экспертов). Цены на конечные точки Alibaba варьируются в зависимости от длины контекста. Если запрос превышает 128 тысяч входных токенов, применяется более высокая цена.

262К контекст·от 37,87 ₽/М

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.

1.0М контекст·от 252,47 ₽/М

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.

1.0М контекст·от 18,94 ₽/М

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 27,01 ₽/М

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

контекст·0,010 ₽ за секунду

Qwen: Qwen3 ASR 0.6B

Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...

контекст·0,010 ₽ за секунду