hubris
T

Thinking Machines: Inkling Small

thinkingmachines/inkling-small
thinkingmachines
Выпущена 30 июля 2026 г.|524К контекст|65,52 ₽/М вход|162,66 ₽/М выход

Inkling Small — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab с 12 миллиардами активных параметров из 276 миллиардов общих. Она позиционируется как меньший и более эффективный член семейства Inkling и подходит для рассуждений, кодирования, агентских рабочих процессов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных бесед.

Провайдер для Thinking Machines: Inkling Small

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

thinkingmachines
Контекст
524К
токенов
Макс. ответ
262К
токенов
Вход
65,52 ₽
за 1М токенов
Выход
162,66 ₽
за 1М токенов
Кеш чтение
13,10 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияАудиоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DeepInfra
65,52 ₽162,66 ₽13,10 ₽100,0 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetop_ktop_p

Другие модели от thinkingmachines