hubris
I

Inception: Mercury 2.5 Preview

inception/mercury-2.5-preview
inception
Выпущена 31 августа 2026 г.|260К контекст|5,05 ₽/М вход|18,95 ₽/М выход

Mercury 2.5 — это самая быстрая LLM для рассуждений и новейшая диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 производит и уточняет несколько токенов параллельно, достигая скорости 1107 токенов/сек на стандартных GPU. Она обеспечивает прирост интеллекта более чем на 10 пунктов по сравнению с Mercury 2, демонстрируя качество, сопоставимое с оптимизированными по стоимости передовыми моделями, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON, соответствующий схеме. Она создана для производственных рабочих нагрузок, где задержка имеет критическое значение: поисковые агенты, голосовые конвейеры и вспомогательные агенты для кодирования.

Провайдер для Inception: Mercury 2.5 Preview

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inception
Контекст
260К
токенов
Макс. ответ
66К
токенов
Вход
5,05 ₽
за 1М токенов
Выход
18,95 ₽
за 1М токенов
Кеш чтение
0,510 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Inception80 %
25,25 ₽5,05 ₽94,75 ₽18,95 ₽2,55 ₽0,510 ₽100,0 %

Поддерживаемые параметры

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools

Другие модели от inception