MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.
Провайдер для MiniMax: Speech 2.8 Turbo
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Голоса
Голос выбирается параметром voice — он обязателен. Всего 45 голосов; подставьте идентификатор целиком, как он написан.
English_expressive_narratorEnglish_radiant_girlEnglish_magnetic_voiced_manEnglish_compelling_lady1English_Aussie_BlokeEnglish_captivating_female1English_Upbeat_WomanEnglish_Trustworth_ManEnglish_CalmWomanEnglish_UpsetGirlEnglish_Gentle-voiced_manEnglish_Whispering_girlПоказать остальные 33
English_Diligent_ManEnglish_Graceful_LadyEnglish_ReservedYoungManEnglish_PlayfulGirlEnglish_ManWithDeepVoiceEnglish_MaturePartnerEnglish_FriendlyPersonEnglish_MatureBossEnglish_DebatorEnglish_LovelyGirlEnglish_SteadymentorEnglish_Deep-VoicedGentlemanEnglish_WiseladyEnglish_CaptivatingStorytellerEnglish_DecentYoungManEnglish_SentimentalLadyEnglish_ImposingMannerEnglish_SadTeenEnglish_PassionateWarriorEnglish_WiseScholarEnglish_Soft-spokenGirlEnglish_SereneWomanEnglish_ConfidentWomanEnglish_PatientManEnglish_ComedianEnglish_BossyLeaderEnglish_Strong-WilledBoyEnglish_StressedLadyEnglish_AssertiveQueenEnglish_AnimeCharacterEnglish_JovialmanEnglish_WhimsicalGirlEnglish_Kind-heartedGirlПоддерживаемые параметры
Другие модели от minimax
MiniMax: H3 Max
MiniMax H3 Max — это модель для генерации видео от MiniMax, выпущенная совместно с fal.ai. Разработанная на основе дополнительного обучения MiniMax H3, она предназначена для более быстрой генерации видео из текста и изображений с...
MiniMax: H3
MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...
MiniMax: Speech 2.8 HD
MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.
MiniMax: MiniMax M3 (batch)
MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.
MiniMax: MiniMax M3
MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.
MiniMax: Hailuo 2.3
Hailuo 2.3 — это модель для генерации видео от MiniMax. Она принимает текстовые запросы и эталонные изображения в качестве входных данных и генерирует видео, поддерживая рабочие процессы как текст-в-видео, так и изображение-в-видео. Это...