hubris
T

Thinking Machines: Inkling (free)

thinkingmachines/inkling:free
thinkingmachines
Выпущена 17 июля 2026 г.|262К контекст|бесплатно/М вход|бесплатно/М выход

Бесплатная конечная точка Inkling доступна только для использования с агентными системами. Не загружайте конфиденциальную информацию или персональные данные (например, голоса и изображения лиц людей). Ваше использование этой бесплатной конечной точки, включая запросы и ответы, регистрируется и используется для улучшения моделей, продуктов и услуг Thinking Machines Lab. Зарегистрированные данные сеанса будут отделены от вашей учетной записи и других постоянных идентификаторов перед использованием для этих целей. Используя эту бесплатную конечную точку, вы соглашаетесь с Условиями использования бесплатного исследовательского API TML. Для получения дополнительной информации о методах обработки данных Thinking Machines Lab см. это Уведомление о конфиденциальности.

⚠ Бесплатная витрина модели

Лимиты RPM/RPD выставляет провайдер модели, не Hubris — конкретные значения провайдер не публикует. При 429 повторите запрос с экспоненциальной задержкой либо переключитесь на платную версию модели. Подробнее.

Провайдер для Thinking Machines: Inkling (free)

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

thinkingmachines
Контекст
262К
токенов
Макс. ответ
262К
токенов
Вход
0 ₽
за 1М токенов
Выход
0 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияАудиоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Thinking Machines
0 ₽0 ₽100,0 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningreasoning_effortseedstoptemperaturetoolstop_p

Другие модели от thinkingmachines

Thinking Machines: Inkling Small

Inkling Small — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab с 12 миллиардами активных параметров из 276 миллиардов общих. Она позиционируется как меньший и более эффективный член семейства Inkling и подходит для рассуждений, кодирования, агентских рабочих процессов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных бесед.

1.0М контекст·от 56,86 ₽/М

Thinking Machines: Inkling Small (free)

Бесплатная конечная точка Inkling Small доступна только для использования с агентными системами. Не загружайте конфиденциальную информацию или персональные данные (например, голоса и изображения лиц людей). Ваше использование этой бесплатной конечной точки, включая запросы и ответы, регистрируется и используется для улучшения моделей, продуктов и услуг Thinking Machines Lab. Зарегистрированные данные сеанса будут отделены от вашей учетной записи и других постоянных идентификаторов перед использованием для этих целей. Используя эту бесплатную конечную точку, вы соглашаетесь с Условиями использования бесплатного исследовательского API TML. Для получения дополнительной информации о методах обработки данных Thinking Machines Lab см. Уведомление о конфиденциальности.

262К контекст·бесплатно

Thinking Machines: Inkling

Inkling — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab, с 41B активных параметров из 975B общих. Она разработана для общего назначения: рассуждений, кодирования, агентных систем и систем использования инструментов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных диалоговых приложений. Её нативная поддержка понимания изображений и аудио обеспечивает мультимодальный анализ наряду с текстом.

1.0М контекст·от 126,36 ₽/М

Thinking Machines: Inkling (batch)

Inkling — это открытая мультимодальная модель Mixture-of-Experts от Thinking Machines Lab, с 41B активных параметров из 975B общих. Она разработана для общего назначения: рассуждений, кодирования, агентных систем и систем использования инструментов, генерации с дополненным поиском (RAG), следования инструкциям и многоязычных диалоговых приложений. Её нативная поддержка понимания изображений и аудио обеспечивает мультимодальный анализ наряду с текстом.

524К контекст·от 126,36 ₽/М