hubris
Логотип NVIDIA — провайдер модели NVIDIA: Nemotron 3 Nano 30B A3B

NVIDIA: Nemotron 3 Nano 30B A3B

nvidia/nemotron-3-nano-30b-a3b
nvidia
Выпущена 14 декабря 2025 г.|262К контекст|7,57 ₽/М вход|30,30 ₽/М выход

NVIDIA Nemotron 3 Nano 30B A3B — это небольшая языковая модель MoE с высочайшей вычислительной эффективностью и точностью, предназначенная для разработчиков, создающих специализированные агентные системы ИИ.

Модель полностью открыта, с открытыми весами, наборами данных и рецептами, поэтому разработчики могут легко настраивать, оптимизировать и развертывать модель на своей инфраструктуре для обеспечения максимальной конфиденциальности и безопасности.

Провайдер для NVIDIA: Nemotron 3 Nano 30B A3B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

nvidia
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
7,57 ₽
за 1М токенов
Выход
30,30 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Crusoe
6,31 ₽25,25 ₽3,79 ₽99,7 %
Novita
6,31 ₽25,25 ₽100,0 %
DeepInfra
6,31 ₽25,25 ₽3,16 ₽98,6 %
Nebius
7,57 ₽30,30 ₽98,2 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от nvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её дизайн FastConformer-RNNT, обусловленный подсказками и учитывающий кэш, предназначен для транскрипции с низкой задержкой на более чем 40 языках для субтитров в реальном времени, голосовых...

контекст·0,010 ₽ за секунду

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning — это открытая модель Mixture-of-Experts от NVIDIA с 3 миллиардами активных параметров из 30 миллиардов общих. Она подходит для высокопроизводительных агентных рабочих нагрузок и специализированных задач, которые выигрывают от доменно-специфической настройки.

1.0М контекст·бесплатно

NVIDIA: Nemotron 3.5 Lightning

Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Данные сеансов, регистрируемые для целей улучшения, не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации о практике обработки данных NVIDIA см. Политику конфиденциальности. Используя эту бесплатную конечную точку, вы соглашаетесь на сбор, запись и использование такой информации компанией NVIDIA, а также с Условиями использования пробной версии API NVIDIA.

262К контекст·от 10,10 ₽/М

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B — это открытая модель встраивания текста от NVIDIA, оптимизированная для высокопроизводительного поиска с низкой задержкой. Она подходит для корпоративного поиска, RAG, поиска кода и рабочих процессов агентского поиска, сохраняя более 95% точности модели 8B при меньших требованиях к развертыванию.

33К контекст·бесплатно

NVIDIA: Nemotron 3.5 Content Safety

NVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель-ограничитель от NVIDIA, доработанная на основе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от LLM и VLM, принимая текстовые и графические входные данные и возвращая текстовый вывод: классификацию пользовательского запроса и ответа как безопасного/небезопасного, метки категорий безопасности и необязательный трассировочный вывод. Она поддерживает 12 языков с контекстным окном до 128K токенов. Модель подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных AI-ограничителей с принудительным применением политик, а также включает переключаемый режим рассуждений. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.

131К контекст·от 25,25 ₽/М

NVIDIA: Nemotron 3.5 Content Safety (free)

NVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель-ограничитель от NVIDIA, доработанная на основе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от LLM и VLM, принимая текстовые и графические входные данные и возвращая текстовый вывод: классификацию пользовательского запроса и ответа как безопасного/небезопасного, метки категорий безопасности и необязательный трассировочный вывод. Она поддерживает 12 языков с контекстным окном до 128K токенов. Модель подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных AI-ограничителей с принудительным применением политик, а также включает переключаемый режим рассуждений. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.

128К контекст·бесплатно