Нейросети для озвучки текста через API
В каталоге Hubris 15 моделей для озвучки текста: доступ через единый OpenAI-совместимый API, оплата картой РФ или СБП, без VPN. Цены — в рублях за токены.
orpheus-3b-0.1-ft
Orpheus 3B — это англоязычная модель преобразования текста в речь от Canopy Labs, доработанная для естественной просодии и выразительной подачи. Она предлагает 7 предустановленных голосов и подходит для повествования, голосовых помощников…
aura-2
Aura-2 — это мультиязычная модель преобразования текста в речь от Deepgram. Она поддерживает канонический каталог голосов Aura-2 от Deepgram для синтеза речи на нескольких языках.
gemini-3.1-flash-tts-preview
Gemini 3.1 Flash TTS Preview — это модель преобразования текста в речь от Google, представляющая собой значительный шаг вперёд по сравнению с Gemini 2.5 Flash TTS. Она принимает текстовый ввод и производит аудиовывод...
kokoro-82m
Kokoro 82M — это легковесная, открытая модель преобразования текста в речь от hexgrad. Она преобразует текст в речь на 8 языках (американский и британский английский, испанский, французский, хинди, итальянский, японский, португальский и…
mai-voice-2
MAI-Voice-2 — это выразительная модель преобразования текста в речь от Microsoft. Она подходит для разговорных помощников, озвучивания медиа, обеспечения доступности, образования и других голосовых приложений с длинными текстами. Она…
mai-voice-2-flash
MAI-Voice-2-Flash — это модель преобразования текста в речь с низкой задержкой от Microsoft, предназначенная для голосовых агентов, ассистентов, колл-центров, обеспечения доступности, озвучивания и других интерактивных приложений. Она…
speech-2.8-hd
MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.
speech-2.8-turbo
MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.
voxtral-mini-tts-2603
Voxtral Mini TTS — это модель преобразования текста в речь от Mistral, поддерживающая клонирование голоса с нулевым обучением и многоязычность. Она преобразует текстовый ввод в естественно звучащий аудиовыход.
qwen-audio-3.0-tts-flash
Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
qwen-audio-3.0-tts-plus
Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.
csm-1b
CSM 1B — это разговорная речевая модель от Sesame. Она принимает текстовый ввод и генерирует англоязычную речь, предлагая варианты голоса в разговорном стиле и стиле чтения. Имея 1 миллиард параметров, она...
grok-voice-tts-1.0
Grok Voice TTS 1.0 — это модель преобразования текста в речь (text-to-speech) от xAI. Она преобразует текст в аудио на более чем 20 языках с автоматическим определением языка и предлагает пять встроенных голосов (Eve, Ara,...
zonos-v0.1-hybrid
Zonos v0.1 Hybrid — это модель преобразования текста в речь от Zyphra, построенная на гибридной архитектуре. Она генерирует англоязычную речь с американским и британским акцентами, как мужскими, так и женскими...
zonos-v0.1-transformer
Zonos v0.1 Transformer — это модель преобразования текста в речь от Zyphra, построенная на чистой архитектуре transformer. Она предлагает то же покрытие голосов американского и британского английского, что и гибридный вариант, и...