hubris
I

inclusionAI: Ling 3.0 Flash VL

inclusionai/ling-3.0-flash-vl
inclusionai
Выпущена 10 сентября 2026 г.|131К контекст|7,57 ₽/М вход|22,72 ₽/М выход

Ling 3.0 Flash VL основан на Ling 3.0 Flash (124B всего / 5.5B активных MoE от InclusionAI), дополнительно усиливая его языковые возможности и добавляя нативное визуальное восприятие и продвинутые визуальные...

Провайдер для inclusionAI: Ling 3.0 Flash VL

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inclusionai
Контекст
131К
токенов
Макс. ответ
33К
токенов
Вход
7,57 ₽
за 1М токенов
Выход
22,72 ₽
за 1М токенов
Кеш чтение
1,51 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DeepInfra
7,57 ₽22,72 ₽1,51 ₽100,0 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Другие модели от inclusionai

inclusionAI: Ling 3.0 Flash VL (free)

Ling 3.0 Flash VL основан на Ling 3.0 Flash (124B всего / 5.5B активных MoE от InclusionAI), дополнительно усиливая его языковые возможности, одновременно добавляя нативное визуальное восприятие и расширенные возможности визуального агента. Гибридная модель мгновенного ответа/рассуждения с вызовом инструментов.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Sante (free)

Ling 3.0 Flash Sante — это модель Mixture-of-Experts от InclusionAI, ориентированная на здравоохранение и медицину, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из 124 млрд общих. Она разработана для рассуждений на основе медицинских знаний, обеспечения клинической безопасности, извлечения информации на основе доказательств и выполнения долгосрочных медицинских задач, сохраняя при этом общие возможности в рассуждениях, кодировании и агентных задачах.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Fin (free)

Ling 3.0 Flash Fin — это модель Mixture-of-Experts от InclusionAI, ориентированная на финансы, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из 124 млрд общих. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, при этом сохраняя общие возможности в рассуждениях, кодировании и математике.

262К контекст·бесплатно

inclusionAI: Ling 3.0 Flash Fin

Ling 3.0 Flash Fin — это финансовая модель типа mixture-of-experts от InclusionAI, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из общего числа в 124 млрд. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, сохраняя при этом общие возможности в рассуждениях, кодировании и математике.

262К контекст·от 7,57 ₽/М

inclusionAI: Ling 3.0 Flash

Ling-3.0-flash — это модель Mixture-of-Experts (MoE) с 124 миллиардами параметров, из которых примерно 5,1 миллиарда параметров активируются на каждый токен. Модель разработана с акцентом на эффективность токенов и агентурный вывод в производственных масштабах, что позволяет разработчикам выполнять более полезную работу в рамках ограниченных бюджетов на токены, задержку и стоимость обслуживания.

262К контекст·от 2,65 ₽/М