hubris
I

inclusionAI: Ling 3.0 Flash

inclusionai/ling-3.0-flash
inclusionai
Выпущена 23 июля 2026 г.|262К контекст|2,65 ₽/М вход|7,95 ₽/М выход

Ling-3.0-flash — это модель Mixture-of-Experts (MoE) с 124 миллиардами параметров, из которых примерно 5,1 миллиарда параметров активируются на каждый токен. Модель разработана с акцентом на эффективность токенов и агентурный вывод в производственных масштабах, что позволяет разработчикам выполнять более полезную работу в рамках ограниченных бюджетов на токены, задержку и стоимость обслуживания.

Провайдер для inclusionAI: Ling 3.0 Flash

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inclusionai
Контекст
262К
токенов
Макс. ответ
33К
токенов
Вход
2,65 ₽
за 1М токенов
Выход
7,95 ₽
за 1М токенов
Кеш чтение
0,530 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
1,36 ₽
по запросам за 30 дней · за 1 млн токенов
Novita65 %
7,57 ₽2,65 ₽22,71 ₽7,95 ₽1,51 ₽0,530 ₽91 т/с100,0 %73,6 %
DeepInfra
7,57 ₽22,72 ₽1,51 ₽24 т/с99,1 %26,4 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от inclusionai

inclusionAI: Ling 3.0 Flash VL

Ling 3.0 Flash VL основан на Ling 3.0 Flash (124B всего / 5.5B активных MoE от InclusionAI), дополнительно усиливая его языковые возможности и добавляя нативное визуальное восприятие и продвинутые визуальные...

131К контекст·от 7,57 ₽/М

inclusionAI: Ling 3.0 Flash VL (free)

Ling 3.0 Flash VL основан на Ling 3.0 Flash (124B всего / 5.5B активных MoE от InclusionAI), дополнительно усиливая его языковые возможности, одновременно добавляя нативное визуальное восприятие и расширенные возможности визуального агента. Гибридная модель мгновенного ответа/рассуждения с вызовом инструментов.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Sante (free)

Ling 3.0 Flash Sante — это модель Mixture-of-Experts от InclusionAI, ориентированная на здравоохранение и медицину, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из 124 млрд общих. Она разработана для рассуждений на основе медицинских знаний, обеспечения клинической безопасности, извлечения информации на основе доказательств и выполнения долгосрочных медицинских задач, сохраняя при этом общие возможности в рассуждениях, кодировании и агентных задачах.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Fin (free)

Ling 3.0 Flash Fin — это модель Mixture-of-Experts от InclusionAI, ориентированная на финансы, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из 124 млрд общих. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, при этом сохраняя общие возможности в рассуждениях, кодировании и математике.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Fin

Ling 3.0 Flash Fin — это финансовая модель типа mixture-of-experts от InclusionAI, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из общего числа в 124 млрд. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, сохраняя при этом общие возможности в рассуждениях, кодировании и математике.

262К контекст·от 7,57 ₽/М