hubris
I

inclusionAI: Ling-2.6-flash

inclusionai/ling-2.6-flash
inclusionai
Выпущена 21 апреля 2026 г.|262К контекст|1,13 ₽/М вход|3,39 ₽/М выход

Ling-2.6-flash — это мгновенная (инструктивная) модель от inclusionAI с общим количеством параметров 104B и 7.4B активных параметров, разработанная для реальных агентов, которым требуются быстрые ответы, высокая производительность и эффективность использования токенов. Она обеспечивает производительность, сравнимую с передовыми моделями аналогичного масштаба, при значительном сокращении использования токенов в рабочих процессах кодирования, обработки документов и легковесных агентов.

Провайдер для inclusionAI: Ling-2.6-flash

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inclusionai
Контекст
262К
токенов
Макс. ответ
33К
токенов
Вход
1,13 ₽
за 1М токенов
Выход
3,39 ₽
за 1М токенов
Кеш чтение
0,230 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Novita90 %
11,30 ₽1,13 ₽33,90 ₽3,39 ₽2,30 ₽0,230 ₽99,3 %

Поддерживаемые параметры

frequency_penaltylogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от inclusionai

Ling-3.0-flash (free)

Ling-3.0-flash — это модель Mixture-of-Experts (MoE) с 124 миллиардами параметров, из которых примерно 5,1 миллиарда параметров активируются на каждый токен. Модель разработана с акцентом на эффективность токенов и агентурный вывод в производственных масштабах, что позволяет разработчикам выполнять более полезную работу в рамках ограниченных бюджетов на токены, задержку и стоимость обслуживания.

262К контекст·бесплатно

inclusionAI: Ring-2.6-1T

Ring-2.6-1T — это модель мышления с 1T параметрами и 63B активными параметрами, созданная для реальных рабочих процессов агентов, требующих как высокой производительности, так и операционной эффективности. Она оптимизирована для кодирующих агентов, использования инструментов и выполнения долгосрочных задач, демонстрируя лидирующие результаты в таких бенчмарках, как PinchBench, ClawEval, TAU2-Bench и GAIA2-search. Благодаря адаптивным усилиям по рассуждению в режимах high и xhigh, Ring-2.6-1T динамически распределяет бюджет рассуждений в зависимости от сложности задачи. Это обеспечивает более высокую производительность при меньших затратах токенов, особенно в рабочих процессах агентов, активно использующих инструменты и многоэтапные взаимодействия. Ring-2.6-1T разработан для продвинутых кодирующих агентов, сложных конвейеров рассуждений и крупномасштабных автономных систем, где важны качество выполнения, задержка и экономическая эффективность.

262К контекст·от 8,47 ₽/М

inclusionAI: Ling-2.6-1T

Ling-2.6-1T — это мгновенная (инструктивная) модель от inclusionAI и флагман компании с триллионом параметров, разработанная для реальных агентов, которым требуется быстрое выполнение и высокая эффективность в масштабе. Она использует подход «быстрого мышления» для снижения затрат примерно до четверти по сравнению с аналогичными моделями, сохраняя при этом высочайшую производительность. Модель достигает самых современных результатов в таких бенчмарках, как AIME26 и SWE-bench Verified, и хорошо подходит для продвинутого кодирования, сложного рассуждения и крупномасштабных рабочих процессов агентов, где критически важны как возможности, так и эффективность.

262К контекст·от 8,47 ₽/М