NVIDIA Nemotron 3 Super — это открытая гибридная MoE-модель со 120 миллиардами параметров, активирующая всего 12 миллиардов параметров для максимальной вычислительной эффективности и точности в сложных многоагентных приложениях. Построенная на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с предсказанием нескольких токенов (MTP), она обеспечивает более чем на 50% более высокую генерацию токенов по сравнению с ведущими открытыми моделями. Модель имеет контекстное окно в 1 миллион токенов для долгосрочной согласованности агентов, кросс-документного рассуждения и многошагового планирования задач. Латентная MoE позволяет вызывать 4 экспертов при стоимости вывода только одного, улучшая интеллект и обобщение. Обучение с подкреплением в нескольких средах (более 10) обеспечивает ведущую точность в бенчмарках, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая, с весами, наборами данных и рецептами под лицензией NVIDIA Open License, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать её где угодно — от рабочей станции до облака.
⚠ Провайдер обучается на данных
Провайдер этой модели может использовать содержимое запросов для обучения своих моделей и хранить промпты. Не отправляйте сюда персональные данные и конфиденциальную информацию — либо выберите модель без этой пометки: для них обучающиеся провайдеры отключены. Подробнее.
⚠ Бесплатная витрина модели
Лимиты RPM/RPD выставляет провайдер модели, не Hubris — конкретные значения провайдер не публикует. При 429 повторите запрос с экспоненциальной задержкой либо переключитесь на платную версию модели. Подробнее.
Провайдер для NVIDIA: Nemotron 3 Super (free)
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Nvidia | 0 ₽ | 0 ₽ | — | 71 т/с | 97,9 % | 100,0 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Статьи по теме
Весь блог →Бесплатная модель для агентов и кода: hubris/free, контекст 200 000 токенов
Как бесплатно работать с моделью hubris/free через программный интерфейс hubris.pw: контекст 200 000 токенов, текст и изображения на входе, цена 0 ₽, примеры для агентов и кода.
Топ-5 бесплатных нейросетей с доступом по API (2026)
Пять бесплатных нейросетей через API: 0 ₽ за токены, контекст до 1 млн, код, агенты и картинки на входе. Идентификаторы моделей и лимит 100 запросов в сутки.
Другие модели от nvidia
NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B
Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её дизайн FastConformer-RNNT, обусловленный подсказками и учитывающий кэш, предназначен для транскрипции с низкой задержкой на более чем 40 языках для субтитров в реальном времени, голосовых...
NVIDIA: Nemotron 3.5 Lightning (free)
NVIDIA Nemotron 3.5 Lightning — это открытая модель Mixture-of-Experts от NVIDIA с 3 миллиардами активных параметров из 30 миллиардов общих. Она подходит для высокопроизводительных агентных рабочих нагрузок и специализированных задач, которые выигрывают от доменно-специфической настройки.
NVIDIA: Nemotron 3.5 Lightning
Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Данные сеансов, регистрируемые для целей улучшения, не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации о практике обработки данных NVIDIA см. Политику конфиденциальности. Используя эту бесплатную конечную точку, вы соглашаетесь на сбор, запись и использование такой информации компанией NVIDIA, а также с Условиями использования пробной версии API NVIDIA.
NVIDIA: Nemotron 3 Embed 1B (free)
NVIDIA Nemotron 3 Embed 1B — это открытая модель встраивания текста от NVIDIA, оптимизированная для высокопроизводительного поиска с низкой задержкой. Она подходит для корпоративного поиска, RAG, поиска кода и рабочих процессов агентского поиска, сохраняя более 95% точности модели 8B при меньших требованиях к развертыванию.
NVIDIA: Nemotron 3.5 Content Safety
NVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель-ограничитель от NVIDIA, доработанная на основе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от LLM и VLM, принимая текстовые и графические входные данные и возвращая текстовый вывод: классификацию пользовательского запроса и ответа как безопасного/небезопасного, метки категорий безопасности и необязательный трассировочный вывод. Она поддерживает 12 языков с контекстным окном до 128K токенов. Модель подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных AI-ограничителей с принудительным применением политик, а также включает переключаемый режим рассуждений. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.
NVIDIA: Nemotron 3.5 Content Safety (free)
NVIDIA Nemotron 3.5 Content Safety — это компактная 4B-параметрическая мультимодальная модель-ограничитель от NVIDIA, доработанная на основе Google Gemma-3-4B. Она модерирует как входные данные, так и ответы от LLM и VLM, принимая текстовые и графические входные данные и возвращая текстовый вывод: классификацию пользовательского запроса и ответа как безопасного/небезопасного, метки категорий безопасности и необязательный трассировочный вывод. Она поддерживает 12 языков с контекстным окном до 128K токенов. Модель подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных AI-ограничителей с принудительным применением политик, а также включает переключаемый режим рассуждений. Она является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.