hubris
Логотип Qwen — провайдер модели Qwen: Qwen3.6 35B A3B

Qwen: Qwen3.6 35B A3B

qwen/qwen3.6-35b-a3b
qwen
Выпущена 27 апреля 2026 г.|262К контекст|12,62 ₽/М вход|113,61 ₽/М выход

Qwen3.6-35B-A3B — это открытая мультимодальная модель от Alibaba Cloud с общим количеством параметров 35 миллиардов и 3 миллиардами активных параметров на токен. Она использует гибридную разреженную архитектуру Mixture-of-Experts, сочетающую линейное внимание Gated DeltaNet со стандартными слоями внимания с гейтингом, что обеспечивает эффективный вывод при значительно меньших вычислительных затратах. Модель поддерживает нативное контекстное окно в 262K токенов (расширяемое до 1M с помощью YaRN) и принимает текстовые, графические и видеовходы. Она включает интегрированный режим мышления с сохранением трассировок рассуждений в многоходовых диалогах, вызов функций и структурированный вывод. Выпущена под лицензией Apache 2.0.

Провайдер для Qwen: Qwen3.6 35B A3B

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
12,62 ₽
за 1М токенов
Выход
113,61 ₽
за 1М токенов
Кеш чтение
6,31 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Darkbloom
6,31 ₽88,37 ₽99,8 %
AkashML
12,62 ₽113,61 ₽6,31 ₽99,8 %
DeepInfra
12,62 ₽119,92 ₽95,2 %
Venice
12,62 ₽126,24 ₽99,9 %
Parasail
18,94 ₽126,24 ₽6,31 ₽100,0 %
AtlasCloud
23,48 ₽140,60 ₽23,48 ₽99,4 %
Io Net
23,98 ₽124,97 ₽12,50 ₽83,3 %
Phala
25,25 ₽160,32 ₽99,7 %
SiliconFlow
30,30 ₽227,23 ₽18,94 ₽97,5 %
CoreWeave
31,56 ₽157,80 ₽31,56 ₽99,9 %

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.

1.0М контекст·от 252,47 ₽/М

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.

1.0М контекст·от 18,94 ₽/М

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 27,01 ₽/М

Qwen: Qwen3.8 27B (free)

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

262К контекст·бесплатно

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

контекст·0,010 ₽ за секунду

Qwen: Qwen3 ASR 0.6B

Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...

контекст·0,010 ₽ за секунду