hubris
I

Ling 3.0 Flash Fin

inclusionai/ling-3.0-flash-fin
inclusionai
Выпущена 27 августа 2026 г.|262К контекст|7,58 ₽/М вход|22,74 ₽/М выход

Ling 3.0 Flash Fin — это финансовая модель типа mixture-of-experts от InclusionAI, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из общего числа в 124 млрд. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, сохраняя при этом общие возможности в рассуждениях, кодировании и математике.

Провайдер для Ling 3.0 Flash Fin

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

inclusionai
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
7,58 ₽
за 1М токенов
Выход
22,74 ₽
за 1М токенов
Кеш чтение
1,52 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

DeepInfra
7,58 ₽22,74 ₽1,52 ₽100,0 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Другие модели от inclusionai

Ling 3.0 Flash Fin (free)

Ling 3.0 Flash Fin — это модель Mixture-of-Experts от InclusionAI, ориентированная на финансы, построенная на базе Ling 3.0 Flash с 5,1 млрд активных параметров из 124 млрд общих. Она разработана для реальных инвестиционных рабочих процессов, требующих сложных многоэтапных задач и долгосрочного планирования и выполнения, при этом сохраняя общие возможности в рассуждениях, кодировании и математике.

262К контекст·бесплатно

Ling-3.0-flash

Ling-3.0-flash — это модель Mixture-of-Experts (MoE) с 124 миллиардами параметров, из которых примерно 5,1 миллиарда параметров активируются на каждый токен. Модель разработана с акцентом на эффективность токенов и агентурный вывод в производственных масштабах, что позволяет разработчикам выполнять более полезную работу в рамках ограниченных бюджетов на токены, задержку и стоимость обслуживания.

262К контекст·от 2,65 ₽/М