hubris
Логотип NVIDIA — провайдер модели NVIDIA: Nemotron 3 Ultra (batch)

NVIDIA: Nemotron 3 Ultra (batch)

nvidia/nemotron-3-ultra-550b-a55b:batch
nvidia
Выпущена 4 июня 2026 г.|512К контекст|75,82 ₽/М вход|454,90 ₽/М выход

Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Зарегистрированные данные сессии для целей улучшения не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации

Провайдер для NVIDIA: Nemotron 3 Ultra (batch)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

nvidia
Контекст
512К
токенов
Макс. ответ
Вход
75,82 ₽
за 1М токенов
Выход
454,90 ₽
за 1М токенов
Кеш чтение
25,27 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Together
75,82 ₽454,90 ₽25,27 ₽

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Другие модели от nvidia

NVIDIA: Nemotron 3 Ultra (free)

NVIDIA Nemotron 3 Ultra — это открытая модель от NVIDIA для рассуждений и оркестрации, с 55 миллиардами активных параметров из 550 миллиардов общих (MoE). Построенная на гибридной архитектуре Transformer-Mamba mixture-of-experts, она поддерживает текстовый ввод и вывод с контекстным окном до 1 миллиона токенов. Она подходит для длительных агентских рабочих процессов, включая оркестрацию агентов, агентов для кодирования, глубокие исследования и сложные корпоративные задачи. Модель особенно сильна в многошаговых рассуждениях и планировании, с высокой пропускной способностью вывода, разработанной для высокообъемных агентских конвейеров. Она является частью семейства открытых моделей NVIDIA Nemotron для агентского ИИ.

1.0М контекст·бесплатно

NVIDIA: Nemotron 3 Super (free)

NVIDIA Nemotron 3 Super — это открытая гибридная MoE-модель со 120 миллиардами параметров, активирующая всего 12 миллиардов параметров для максимальной вычислительной эффективности и точности в сложных многоагентных приложениях. Построенная на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с предсказанием нескольких токенов (MTP), она обеспечивает более чем на 50% более высокую генерацию токенов по сравнению с ведущими открытыми моделями. Модель имеет контекстное окно в 1 миллион токенов для долгосрочной согласованности агентов, кросс-документного рассуждения и многошагового планирования задач. Латентная MoE позволяет вызывать 4 экспертов при стоимости вывода только одного, улучшая интеллект и обобщение. Обучение с подкреплением в нескольких средах (более 10) обеспечивает ведущую точность в бенчмарках, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая, с весами, наборами данных и рецептами под лицензией NVIDIA Open License, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать её где угодно — от рабочей станции до облака.

262К контекст·бесплатно

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её дизайн FastConformer-RNNT, обусловленный подсказками и учитывающий кэш, предназначен для транскрипции с низкой задержкой на более чем 40 языках для субтитров в реальном времени, голосовых...

контекст·0,010 ₽ за секунду

NVIDIA: Nemotron 3.5 Lightning

Для бесплатной конечной точки, пожалуйста, не загружайте конфиденциальную информацию или персональные данные (такие как голоса или лица людей). Ваше использование регистрируется в целях безопасности и для улучшения продуктов и услуг NVIDIA. Данные сеансов, регистрируемые для целей улучшения, не связаны с вашей личностью или каким-либо постоянным идентификатором. Для получения дополнительной информации о практике обработки данных NVIDIA см. Политику конфиденциальности. Используя эту бесплатную конечную точку, вы соглашаетесь на сбор, запись и использование такой информации компанией NVIDIA, а также с Условиями использования пробной версии API NVIDIA.

1.0М контекст·от 10,11 ₽/М

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning — это открытая модель Mixture-of-Experts от NVIDIA с 3 миллиардами активных параметров из 30 миллиардов общих. Она подходит для высокопроизводительных агентных рабочих нагрузок и специализированных задач, которые выигрывают от доменно-специфической настройки.

1.0М контекст·бесплатно

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B — это открытая модель встраивания текста от NVIDIA, оптимизированная для высокопроизводительного поиска с низкой задержкой. Она подходит для корпоративного поиска, RAG, поиска кода и рабочих процессов агентского поиска, сохраняя более 95% точности модели 8B при меньших требованиях к развертыванию.

33К контекст·бесплатно