hubris
Логотип NVIDIA — провайдер модели NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

nvidia/nemotron-3.5-asr-streaming-multilingual-0.6b
nvidia
Выпущена 13 августа 2026 г.|0,010 ₽ за секунду

Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её дизайн FastConformer-RNNT, обусловленный подсказками и учитывающий кэш, предназначен для транскрипции с низкой задержкой на более чем 40 языках для субтитров в реальном времени, голосовых...

Провайдер для NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

nvidia
Контекст
токенов
Макс. ответ
Аудиозапись
0,010 ₽
за секунду

Модальности

Вход:АудиоВыход:Транскрибация

Поддерживаемые параметры

frequency_penaltymax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstoptemperaturetop_ktop_p

Другие модели от nvidia

NVIDIA: Nemotron 3.5 Lightning

Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Данные сеансов, регистрируемые для целей улучшения, не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации о практике обработки данных NVIDIA см. Политику конфиденциальности. Используя эту бесплатную конечную точку, вы соглашаетесь на сбор, запись и использование такой информации компанией NVIDIA, а также с Условиями использования пробной версии API NVIDIA.

262К контекст·от 10,11 ₽/М

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning — это открытая модель Mixture-of-Experts от NVIDIA с 3 миллиардами активных параметров из 30 миллиардов общих. Она подходит для высокопроизводительных агентных рабочих нагрузок и специализированных задач, которые выигрывают от доменно-специфической настройки.

1.0М контекст·бесплатно

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B — это открытая модель встраивания текста от NVIDIA, оптимизированная для высокопроизводительного поиска с низкой задержкой. Она подходит для корпоративного поиска, RAG, поиска кода и рабочих процессов агентского поиска, сохраняя более 95% точности модели 8B при меньших требованиях к развертыванию.

33К контекст·бесплатно

NVIDIA: Nemotron 3.5 Content Safety (free)

NVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель-ограничитель от NVIDIA, доработанная на основе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от LLM и VLM, принимая текстовые и графические входные данные и возвращая текстовый вывод: классификацию пользовательского запроса и ответа как безопасного/небезопасного, метки категорий безопасности и необязательный трассировочный вывод. Она поддерживает 12 языков с контекстным окном до 128K токенов. Модель подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных AI-ограничителей с принудительным применением политик, а также включает переключаемый режим рассуждений. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.

128К контекст·бесплатно

NVIDIA: Nemotron 3 Ultra

NVIDIA Nemotron 3 Ultra — это открытая модель от NVIDIA для рассуждений и оркестрации, с 55 млрд активных параметров из 550 млрд общих (MoE). Построенная на гибридной архитектуре Transformer-Mamba mixture-of-experts, она поддерживает текстовый ввод и вывод с контекстным окном до 1M токенов. Модель подходит для длительных агентных рабочих процессов, включая оркестрацию агентов, кодирующих агентов, глубокие исследования и сложные корпоративные задачи. Она особенно сильна в многошаговых рассуждениях и планировании, с высокопроизводительным выводом, разработанным для высокообъемных агентных конвейеров. Модель является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.

512К контекст·от 75,82 ₽/М

NVIDIA: Nemotron 3 Ultra (batch)

Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Зарегистрированные данные сессии для целей улучшения не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации

512К контекст·от 75,82 ₽/М