hubris

Нейросети для озвучки текста через API

В каталоге Hubris 15 моделей для озвучки текста: доступ через единый OpenAI-совместимый API, оплата картой РФ или СБП, без VPN. Цены — в рублях за токены.

Ccanopylabs

orpheus-3b-0.1-ft

Orpheus 3B — это англоязычная модель преобразования текста в речь от Canopy Labs, доработанная для естественной просодии и выразительной подачи. Она предлагает 7 предустановленных голосов и подходит для повествования, голосовых помощников…

791за 1М символов
7 голосовtts · json
Открыть →
Ddeepgram

aura-2

Aura-2 — это мультиязычная модель преобразования текста в речь от Deepgram. Она поддерживает канонический каталог голосов Aura-2 от Deepgram для синтеза речи на нескольких языках.

3 392за 1М символов
90 голосовtts
Открыть →
Логотип Google Geminigoogle

gemini-3.1-flash-tts-preview

Gemini 3.1 Flash TTS Preview — это модель преобразования текста в речь от Google, представляющая собой значительный шаг вперёд по сравнению с Gemini 2.5 Flash TTS. Она принимает текстовый ввод и производит аудиовывод...

113за 1М символов
30 голосовtts · json
Открыть →
Hhexgrad

kokoro-82m

Kokoro 82M — это легковесная, открытая модель преобразования текста в речь от hexgrad. Она преобразует текст в речь на 8 языках (американский и британский английский, испанский, французский, хинди, итальянский, японский, португальский и…

70,11за 1М символов
54 голосаtts · json
Открыть →
Логотип Microsoftmicrosoft

mai-voice-2

MAI-Voice-2 — это выразительная модель преобразования текста в речь от Microsoft. Она подходит для разговорных помощников, озвучивания медиа, обеспечения доступности, образования и других голосовых приложений с длинными текстами. Она…

2 487за 1М символов
4 голосаtts
Открыть →
Логотип Microsoftmicrosoft

mai-voice-2-flash

MAI-Voice-2-Flash — это модель преобразования текста в речь с низкой задержкой от Microsoft, предназначенная для голосовых агентов, ассистентов, колл-центров, обеспечения доступности, озвучивания и других интерактивных приложений. Она…

1 696за 1М символов
4 голосаtts
Открыть →
Логотип MiniMaxminimax

speech-2.8-hd

MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.

11 306за 1М символов
tts
Открыть →
Логотип MiniMaxminimax

speech-2.8-turbo

MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.

6 784за 1М символов
tts
Открыть →
Логотип Mistral AImistralai

voxtral-mini-tts-2603

Voxtral Mini TTS — это модель преобразования текста в речь от Mistral, поддерживающая клонирование голоса с нулевым обучением и многоязычность. Она преобразует текстовый ввод в естественно звучащий аудиовыход.

1 809за 1М символов
30 голосовtts · json
Открыть →
Логотип Qwenqwen

qwen-audio-3.0-tts-flash

Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

1 696за 1М символов
2 голосаtts · json
Открыть →
Логотип Qwenqwen

qwen-audio-3.0-tts-plus

Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

2 261за 1М символов
2 голосаtts · json
Открыть →
Ssesame

csm-1b

CSM 1B — это разговорная речевая модель от Sesame. Она принимает текстовый ввод и генерирует англоязычную речь, предлагая варианты голоса в разговорном стиле и стиле чтения. Имея 1 миллиард параметров, она...

791за 1М символов
7 голосовtts · json
Открыть →
x-ai

grok-voice-tts-1.0

Grok Voice TTS 1.0 — это модель преобразования текста в речь (text-to-speech) от xAI. Она преобразует текст в аудио на более чем 20 языках с автоматическим определением языка и предлагает пять встроенных голосов (Eve, Ara,...

1 696за 1М символов
5 голосовtts · json
Открыть →
Zzyphra

zonos-v0.1-hybrid

Zonos v0.1 Hybrid — это модель преобразования текста в речь от Zyphra, построенная на гибридной архитектуре. Она генерирует англоязычную речь с американским и британским акцентами, как мужскими, так и женскими...

791за 1М символов
5 голосовtts · json
Открыть →
Zzyphra

zonos-v0.1-transformer

Zonos v0.1 Transformer — это модель преобразования текста в речь от Zyphra, построенная на чистой архитектуре transformer. Она предлагает то же покрытие голосов американского и британского английского, что и гибридный вариант, и...

791за 1М символов
5 голосовtts · json
Открыть →