Inkling — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab, с 41B активных параметров из 975B общих. Она разработана для общего назначения: рассуждений, кодирования, агентных систем и систем использования инструментов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных диалоговых приложений. Её нативная поддержка понимания изображений и аудио обеспечивает мультимодальный анализ наряду с текстом.
Провайдер для Thinking Machines: Inkling (batch)
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Together | 57,36 ₽ | 232,29 ₽ | 9,75 ₽ | — | — |
Поддерживаемые параметры
Другие модели от thinkingmachines
Thinking Machines: Inkling Small
Inkling Small — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab с 12 миллиардами активных параметров из 276 миллиардов общих. Она позиционируется как меньший и более эффективный член семейства Inkling и подходит для рассуждений, кодирования, агентских рабочих процессов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных бесед.
Thinking Machines: Inkling
Inkling — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab, с 41B активных параметров из 975B общих. Она разработана для общего назначения: рассуждений, кодирования, агентных систем и систем использования инструментов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных диалоговых приложений. Её нативная поддержка понимания изображений и аудио обеспечивает мультимодальный анализ наряду с текстом.