hubris
I

Inception: Mercury 2

inception/mercury-2
inception
Выпущена 4 марта 2026 г.|128К контекст|28,24 ₽/М вход|84,72 ₽/М выход

Mercury 2 — это чрезвычайно быстрая LLM для рассуждений и первая диффузионная LLM (dLLM) для рассуждений. Вместо последовательной генерации токенов Mercury 2 производит и уточняет несколько токенов параллельно, достигая скорости >1000 токенов/сек на стандартных GPU. Mercury 2 в 5 раз быстрее, чем ведущие LLM, оптимизированные по скорости, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньшей стоимости. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст 128K, нативное использование инструментов и вывод JSON, соответствующий схеме. Создан для рабочих процессов кодирования, где задержка накапливается, голосового поиска/поиска в реальном времени и циклов агентов. Совместим с OpenAI API. Подробнее читайте в блоге.

Провайдер для Inception: Mercury 2

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inception
Контекст
128К
токенов
Макс. ответ
50К
токенов
Вход
28,24 ₽
за 1М токенов
Выход
84,72 ₽
за 1М токенов
Кеш чтение
2,82 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Inception
28,24 ₽84,72 ₽2,82 ₽100,0 %

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools