hubris
Логотип MiniMax — провайдер модели MiniMax: MiniMax-01

MiniMax: MiniMax-01

minimax/minimax-01
minimax
Выпущена 15 января 2025 г.|1.0М контекст|25,25 ₽/М вход|138,86 ₽/М выход

MiniMax-01 сочетает MiniMax-Text-01 для генерации текста и MiniMax-VL-01 для понимания изображений. Он имеет 456 миллиардов параметров, при этом 45,9 миллиарда параметров активируются за одно логическое выведение, и может обрабатывать контекст до 4 миллионов токенов.

Текстовая модель использует гибридную архитектуру, которая сочетает Lightning Attention, Softmax Attention и Mixture-of-Experts (MoE). Модель изображений использует фреймворк «ViT-MLP-LLM» и обучается поверх текстовой модели.

Чтобы узнать больше о выпуске, см.: https://www.minimaxi.com/en/news/minimax-01-series-2

Провайдер для MiniMax: MiniMax-01

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

minimax
Контекст
1.0М
токенов
Макс. ответ
900К
токенов
Вход
25,25 ₽
за 1М токенов
Выход
138,86 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Minimax
25,25 ₽138,86 ₽99,5 %

Поддерживаемые параметры

max_tokenstemperaturetop_p

Другие модели от minimax

MiniMax: H3 Max

MiniMax H3 Max — это модель для генерации видео от MiniMax, выпущенная совместно с fal.ai. Разработанная на основе дополнительного обучения MiniMax H3, она предназначена для более быстрой генерации видео из текста и изображений с...

контекст·9,99 ₽ за секунду

MiniMax: H3

MiniMax H3 — это легковесная модель для генерации видео с открытым исходным кодом от MiniMax. Она разработана для точного мультимодального редактирования и контролируемой генерации контента, включая редактирование по инструкциям, рендеринг текста и брендов, а также...

контекст·16,23 ₽ за секунду

MiniMax: Speech 2.8 HD

MiniMax Speech 2.8 HD — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют речь из текста и принимает произвольные идентификаторы голоса MiniMax.

контекст·12 623,65 ₽ за 1М символов

MiniMax: Speech 2.8 Turbo

MiniMax Speech 2.8 Turbo — это модель преобразования текста в речь от MiniMax. Она подходит для приложений, которые генерируют голосовое аудио из текста, и принимает произвольные идентификаторы голоса MiniMax.

контекст·7 574,19 ₽ за 1М символов

MiniMax: MiniMax M3 (batch)

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1 миллион токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1 миллионе токенов, со значительно более быстрым заполнением и декодированием, сохраняя при этом качество в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной системы симулятора пользователя, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

524К контекст·от 37,87 ₽/М

MiniMax: MiniMax M3

MiniMax-M3 — это мультимодальная базовая модель от MiniMax. Она поддерживает текстовые, графические и видеовходы с текстовым выводом, имеет контекстное окно в 1M токенов и подходит для долгосрочной агентной работы, кодирования и использования инструментов. Модель построена на MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для сокращения вычислений на токен при длинном контексте — примерно в 20 раз дешевле по сравнению с предыдущим поколением при 1M токенов, со значительно более быстрым заполнением и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на перемежающихся данных и настроенная для многоэтапного, производственного сотрудничества с помощью интерактивной пользовательской симуляторной платформы, модель ориентирована на устойчивые, многошаговые задачи, а не на одноэтапное выполнение.

1.0М контекст·от 37,87 ₽/М