hubris
Логотип Tencent Hunyuan — провайдер модели Tencent: Hy-MT2-30B-A3B

Tencent: Hy-MT2-30B-A3B

tencent/hy-mt2-30b-a3b
tencent
Выпущена 20 августа 2026 г.| контекст|9,35 ₽/М вход|37,28 ₽/М выход

Hy-MT2-30B-A3B — это флагманская модель перевода от Tencent в семействе Hy-MT2. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и управляемого стилем перевода. Модель использует 3 миллиарда активных параметров из 30 миллиардов общих.

Провайдер для Tencent: Hy-MT2-30B-A3B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

tencent
Контекст
токенов
Макс. ответ
токенов
Вход
9,35 ₽
за 1М токенов
Выход
37,28 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Tencent
9,35 ₽37,28 ₽100,0 %

Поддерживаемые параметры

max_completion_tokensmax_tokensresponse_formatstopstructured_outputstemperature

Другие модели от tencent

Tencent: Hy-MT2-1.8B

Hy-MT2-1.8B — это компактная модель перевода от Tencent с 1,8 миллиардами параметров. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и управляемого стилем перевода.

контекст·от 5,56 ₽/М

Tencent: Hy-MT2-7B

Hy-MT2-7B — это модель перевода от Tencent с 7 миллиардами параметров. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, глоссарийного и стилевого перевода.

контекст·от 9,35 ₽/М

Tencent: Hy3

Hy3 — это модель Mixture-of-Experts от Tencent с 295 миллиардами параметров (21 миллиард активных, 192 эксперта с маршрутизацией top-8), созданная для рассуждений, агентских рабочих процессов и реального производственного использования. Она поддерживает настраиваемое усилие рассуждений: прямой режим без размышлений по умолчанию, а также режимы цепочки рассуждений низкой и высокой сложности для сложных математических задач, кодирования и многошаговых проблем. С окном контекста в 256K Hy3 нацелена на долгосрочные задачи, включая улучшенное разрешение кореференции, отслеживание многошаговых ограничений и стабильный вызов инструментов, который обобщается по различным агентским структурам. Tencent позиционирует её как надёжный, экономически эффективный вариант для кодирования, обработки документов, финансового анализа, разработки игр и фронтенд-дизайна, с сильным акцентом на обоснованное, антигаллюцинационное поведение, которое даёт ответы, когда они обоснованы, и сигнализирует об отсутствии доказательств, вместо того чтобы их фабриковать.

262К контекст·от 16,68 ₽/М

Tencent: Hy3 preview

Hy3 preview — это высокоэффективная модель Mixture-of-Experts от Tencent, разработанная для агентских рабочих процессов и использования в производстве. Она поддерживает настраиваемые уровни рассуждений в режимах «отключено», «низкий» и «высокий», что позволяет ей балансировать между скоростью и глубиной в зависимости от задачи, обеспечивая при этом мощную генерацию кода и надежную производительность в многоэтапных, реальных рабочих процессах.

262К контекст·от 22,74 ₽/М

Tencent: Hunyuan A13B Instruct

Hunyuan-A13B — это языковая модель Mixture-of-Experts (MoE) с 13 миллиардами активных параметров, разработанная Tencent, с общим количеством параметров 80 миллиардов и поддержкой рассуждений через Chain-of-Thought. Она демонстрирует конкурентоспособные результаты в бенчмарках по математике, естественным наукам, программированию и многошаговым рассуждениям, сохраняя при этом высокую эффективность инференса благодаря Grouped Query Attention (GQA) и поддержке квантования (FP8, GPTQ и т. д.).

131К контекст·от 17,69 ₽/М