hubris
Логотип MiniMax — провайдер модели MiniMax: MiniMax M3

MiniMax: MiniMax M3

minimax/minimax-m3
minimax
Выпущена 31 мая 2026 г.|1.0М контекст|37,91 ₽/М вход|151,63 ₽/М выход

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач.

Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

Провайдер для MiniMax: MiniMax M3

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

minimax
Контекст
1.0М
токенов
Макс. ответ
512К
токенов
Вход
37,91 ₽
за 1М токенов
Выход
151,63 ₽
за 1М токенов
Кеш чтение
7,58 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
10,02 ₽
по запросам за 30 дней · за 1 млн токенов
CoreWeave
29,06 ₽121,31 ₽6,32 ₽98,9 %< 0,1 %
GMICloud60 %
75,82 ₽30,33 ₽303,27 ₽121,31 ₽15,18 ₽6,07 ₽38 т/с99,1 %20,7 %
DeepInfra
35,38 ₽139,00 ₽7,08 ₽16 т/с96,6 %13,3 %
Novita
37,91 ₽151,63 ₽7,58 ₽76 т/с99,4 %10,7 %
Venice
37,91 ₽151,63 ₽7,58 ₽85 т/с99,8 %9,6 %
Minimax
37,91 ₽151,63 ₽7,58 ₽71 т/с99,5 %9,8 %
AtlasCloud
37,91 ₽151,63 ₽7,58 ₽60 т/с99,3 %27,6 %
Together
37,91 ₽151,63 ₽7,58 ₽99,1 %< 0,1 %
StreamLake50 %
75,82 ₽37,91 ₽303,26 ₽151,63 ₽15,16 ₽7,58 ₽98,7 %< 0,1 %
Parasail
37,91 ₽151,63 ₽7,58 ₽8,4 т/с98,0 %5,8 %
Morph
37,91 ₽151,63 ₽48 т/с94,7 %1,3 %
ModelRun
94,77 ₽379,08 ₽18,95 ₽99,1 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от minimax

MiniMax: H3

MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...

контекст·23,20 ₽ за секунду

MiniMax: Speech 2.8 HD

MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.

контекст·12 636,09 ₽ за 1М символов

MiniMax: Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.

контекст·7 581,65 ₽ за 1М символов

MiniMax: MiniMax M3 (batch)

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

524К контекст·от 37,91 ₽/М

MiniMax: Hailuo 2.3

Hailuo 2.3 — это модель для генерации видео от MiniMax. Она принимает текстовые запросы и эталонные изображения в качестве входных данных и генерирует видео, поддерживая рабочие процессы как текст-в-видео, так и изображение-в-видео. Это...

контекст·14,58 ₽ за секунду

MiniMax: MiniMax M2.7

MiniMax-M2.7 — это крупная языковая модель нового поколения, разработанная для автономной, реальной продуктивности и непрерывного совершенствования. Созданная для активного участия в собственной эволюции, M2.7 интегрирует передовые агентные возможности посредством многоагентного сотрудничества, позволяя ей планировать, выполнять и уточнять сложные задачи в динамичных средах. Обученная для производительности производственного уровня, M2.7 обрабатывает рабочие процессы, такие как отладка в реальном времени, анализ первопричин, финансовое моделирование и полная генерация документов в Word, Excel и PowerPoint. Она демонстрирует высокие результаты в бенчмарках, включая 56,2% на SWE-Pro и 57,0% на Terminal Bench 2, при этом достигая 1495 ELO на GDPval-AA, устанавливая новый стандарт для многоагентных систем, работающих в реальных цифровых рабочих процессах.

205К контекст·от 37,91 ₽/М