Qwen3-235B-A22B-Instruct-2507 — это многоязычная, настроенная на инструкции языковая модель типа Mixture-of-Experts, основанная на архитектуре Qwen3-235B, с 22 миллиардами активных параметров на прямой проход. Она оптимизирована для генерации текста общего назначения, включая следование инструкциям, логическое рассуждение, математику, код и использование инструментов. Модель поддерживает нативную длину контекста в 262K и не реализует «режим мышления» (блоки <think>).
По сравнению со своим базовым вариантом, эта версия демонстрирует значительные улучшения в охвате знаний, рассуждениях в длинном контексте, бенчмарках кодирования и согласованности с открытыми задачами. Она особенно сильна в многоязычном понимании, математических рассуждениях (например, AIME, HMMT) и оценках согласованности, таких как Arena-Hard и WritingBench.
Провайдер для Qwen: Qwen3 235B A22B Instruct 2507
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
GMICloud−75 % | — | 97,8 % | |||
DeepInfra | 11,36 ₽ | 69,43 ₽ | — | — | 97,4 % |
Novita | 11,36 ₽ | 73,22 ₽ | — | — | 99,0 % |
Parasail | 17,67 ₽ | 100,99 ₽ | 6,31 ₽ | — | 99,2 % |
Alibaba | 18,87 ₽ | 75,49 ₽ | — | — | 100,0 % |
Venice | 18,94 ₽ | 94,68 ₽ | — | — | 96,9 % |
Nebius | 25,25 ₽ | 75,74 ₽ | — | — | 92,2 % |
StreamLake−40 % | — | — | 98,1 % | ||
Google | 27,77 ₽ | 111,09 ₽ | — | — | 100,0 % |
Google | 31,56 ₽ | 126,24 ₽ | — | — | 99,9 % |
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от qwen
Qwen: Qwen3.8 Max (0902)
Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.
Qwen: Qwen3.8 Flash
Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.
Qwen: Qwen3.8 27B (free)
Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.
Qwen: Qwen3.8 27B
Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.
Qwen: Qwen3 ASR 1.7B
Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...
Qwen: Qwen3 ASR 0.6B
Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...