MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач.
Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.
Провайдер для MiniMax: MiniMax M3
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
CoreWeave | 29,06 ₽ | 121,31 ₽ | 6,32 ₽ | — | 100,0 % | < 0,1 % |
DeepInfra | 35,38 ₽ | 139,00 ₽ | 7,08 ₽ | 16 т/с | 98,6 % | 0,4 % |
StreamLake−50 % | 70 т/с | 97,7 % | 0,3 % | |||
Venice | 37,91 ₽ | 151,63 ₽ | 7,58 ₽ | 213 т/с | 100,0 % | 10,1 % |
Parasail | 37,91 ₽ | 151,63 ₽ | 7,58 ₽ | 49 т/с | 99,3 % | 23,5 % |
AtlasCloud | 37,91 ₽ | 151,63 ₽ | 7,58 ₽ | 57 т/с | 97,6 % | 0,5 % |
Novita | 37,91 ₽ | 151,63 ₽ | 7,58 ₽ | 71 т/с | 99,5 % | 48,4 % |
Minimax | 37,91 ₽ | 151,63 ₽ | 7,58 ₽ | 41 т/с | 99,4 % | 16,5 % |
SambaNova | 75,82 ₽ | 303,27 ₽ | — | — | 98,4 % | < 0,1 % |
GMICloud | 75,82 ₽ | 303,27 ₽ | 15,16 ₽ | 47 т/с | 97,7 % | 0,2 % |
ModelRun | 94,77 ₽ | 379,08 ₽ | 18,95 ₽ | — | 99,1 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от minimax
MiniMax: H3 Max
MiniMax H3 Max — это модель для генерации видео от MiniMax, выпущенная совместно с fal.ai. Разработанная на основе дополнительного обучения MiniMax H3, она предназначена для более быстрой генерации видео из текста и изображений с...
MiniMax: H3
MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...
MiniMax: Speech 2.8 HD
MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.
MiniMax: Speech 2.8 Turbo
MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.
MiniMax: MiniMax M3 (free)
MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на однократное выполнение.
MiniMax: MiniMax M3 (batch)
MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.