hubris
Логотип MiniMax — провайдер модели MiniMax: MiniMax M2-her

MiniMax: MiniMax M2-her

minimax/minimax-m2-her
minimax
Выпущена 23 января 2026 г.|66К контекст|37,87 ₽/М вход|151,48 ₽/М выход

MiniMax M2-her — это большая языковая модель, ориентированная на диалог, созданная для иммерсивных ролевых игр, чатов, управляемых персонажами, и выразительных многоходовых бесед. Разработанная для поддержания согласованности тона и индивидуальности, она поддерживает богатые роли сообщений (user_system, group, sample_message_user, sample_message_ai) и может учиться на примерах диалогов, чтобы лучше соответствовать стилю и темпу вашего сценария, что делает ее отличным выбором для рассказывания историй, компаньонов и разговорных взаимодействий, где естественный поток и яркое общение имеют наибольшее значение.

Провайдер для MiniMax: MiniMax M2-her

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

minimax
Контекст
66К
токенов
Макс. ответ
токенов
Вход
37,87 ₽
за 1М токенов
Выход
151,48 ₽
за 1М токенов
Кеш чтение
3,79 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Minimax
37,87 ₽151,48 ₽3,79 ₽100,0 %

Поддерживаемые параметры

max_tokenstemperaturetop_p

Другие модели от minimax

MiniMax: H3 Max

MiniMax H3 Max — это модель для генерации видео от MiniMax, выпущенная совместно с fal.ai. Разработанная на основе дополнительного обучения MiniMax H3, она предназначена для более быстрой генерации видео из текста и изображений с...

контекст·9,99 ₽ за секунду

MiniMax: H3

MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...

контекст·16,23 ₽ за секунду

MiniMax: Speech 2.8 HD

MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.

контекст·12 623,65 ₽ за 1М символов

MiniMax: Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.

контекст·7 574,19 ₽ за 1М символов

MiniMax: MiniMax M3 (batch)

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

524К контекст·от 37,87 ₽/М

MiniMax: MiniMax M3

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

1.0М контекст·от 37,87 ₽/М