hubris
I

Inference.net: Schematron V2 Turbo

inference-net/schematron-v2-turbo
inference-net
Выпущена 12 сентября 2026 г.|128К контекст|3,79 ₽/М вход|18,94 ₽/М выход

Schematron V2 Turbo — это модель для извлечения HTML в JSON с 3 миллиардами параметров от Inference.net. Она ориентирована на пропускную способность для рабочих нагрузок с большим объемом извлечения данных. Инструкции по извлечению должны быть предоставлены через JSON-схему в response_format, а не через системные или пользовательские prompt'ы.

Провайдер для Inference.net: Schematron V2 Turbo

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inference-net
Контекст
128К
токенов
Макс. ответ
токенов
Вход
3,79 ₽
за 1М токенов
Выход
18,94 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

InferenceNet
3,79 ₽18,94 ₽100,0 %

Поддерживаемые параметры

frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyresponse_formatseedstopstructured_outputstemperaturetop_ktop_p

Другие модели от inference-net