hubris
Логотип MiniMax — провайдер модели MiniMax: MiniMax M3

MiniMax: MiniMax M3

minimax/minimax-m3
minimax
Выпущена 31 мая 2026 г.|1.0М контекст|37,91 ₽/М вход|151,63 ₽/М выход

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач.

Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

Провайдер для MiniMax: MiniMax M3

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

minimax
Контекст
1.0М
токенов
Макс. ответ
512К
токенов
Вход
37,91 ₽
за 1М токенов
Выход
151,63 ₽
за 1М токенов
Кеш чтение
7,58 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
10,66 ₽
по запросам за 30 дней · за 1 млн токенов
CoreWeave
29,06 ₽121,31 ₽6,32 ₽100,0 %< 0,1 %
DeepInfra
35,38 ₽139,00 ₽7,08 ₽16 т/с98,6 %0,4 %
StreamLake50 %
75,82 ₽37,91 ₽303,26 ₽151,63 ₽15,16 ₽7,58 ₽70 т/с97,7 %0,3 %
Venice
37,91 ₽151,63 ₽7,58 ₽213 т/с100,0 %10,1 %
Parasail
37,91 ₽151,63 ₽7,58 ₽49 т/с99,3 %23,5 %
AtlasCloud
37,91 ₽151,63 ₽7,58 ₽57 т/с97,6 %0,5 %
Novita
37,91 ₽151,63 ₽7,58 ₽71 т/с99,5 %48,4 %
Minimax
37,91 ₽151,63 ₽7,58 ₽41 т/с99,4 %16,5 %
SambaNova
75,82 ₽303,27 ₽98,4 %< 0,1 %
GMICloud
75,82 ₽303,27 ₽15,16 ₽47 т/с97,7 %0,2 %
ModelRun
94,77 ₽379,08 ₽18,95 ₽99,1 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от minimax

MiniMax: H3 Max

MiniMax H3 Max — это модель для генерации видео от MiniMax, выпущенная совместно с fal.ai. Разработанная на основе дополнительного обучения MiniMax H3, она предназначена для более быстрой генерации видео из текста и изображений с...

контекст·14,28 ₽ за секунду

MiniMax: H3

MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...

контекст·23,20 ₽ за секунду

MiniMax: Speech 2.8 HD

MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.

контекст·12 636,09 ₽ за 1М символов

MiniMax: Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.

контекст·7 581,65 ₽ за 1М символов

MiniMax: MiniMax M3 (free)

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на однократное выполнение.

1.0М контекст·бесплатно

MiniMax: MiniMax M3 (batch)

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

524К контекст·от 37,91 ₽/М