Inkling Small — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab с 12 миллиардами активных параметров из 276 миллиардов общих. Она позиционируется как меньший и более эффективный член семейства Inkling и подходит для рассуждений, кодирования, агентских рабочих процессов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных бесед.
Провайдер для Thinking Machines: Inkling Small
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
DeepInfra | 65,52 ₽ | 162,66 ₽ | 13,10 ₽ | — | 100,0 % |