Schematron V2 Turbo — это модель для извлечения HTML в JSON с 3 миллиардами параметров от Inference.net. Она ориентирована на пропускную способность для рабочих нагрузок с большим объемом извлечения данных. Инструкции по извлечению должны быть предоставлены через JSON-схему в response_format, а не через системные или пользовательские prompt'ы.
Провайдер для Inference.net: Schematron V2 Turbo
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
InferenceNet | 3,79 ₽ | 18,94 ₽ | — | — | 100,0 % |