hubris
Логотип Qwen — провайдер модели Qwen: Qwen3 30B A3B Instruct 2507

Qwen: Qwen3 30B A3B Instruct 2507

qwen/qwen3-30b-a3b-instruct-2507
qwen
Выпущена 29 июля 2025 г.|262К контекст|5,44 ₽/М вход|21,81 ₽/М выход

Qwen3-30B-A3B-Instruct-2507 — это языковая модель Qwen с 30,5 миллиардами параметров, использующая архитектуру MoE, с 3,3 миллиардами активных параметров на вывод. Она работает в немыслящем режиме и предназначена для высококачественного следования инструкциям, многоязычного понимания и использования инструментов агентами. После дообучения на данных инструкций она демонстрирует конкурентоспособную производительность в задачах рассуждения (AIME, ZebraLogic), кодирования (MultiPL-E, LiveCodeBench) и выравнивания (IFEval, WritingBench). Она превосходит свой неинструктивный вариант в субъективных и открытых задачах, сохраняя при этом высокую производительность в задачах, связанных с фактами и кодированием.

Провайдер для Qwen: Qwen3 30B A3B Instruct 2507

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
262К
токенов
Макс. ответ
32К
токенов
Вход
5,44 ₽
за 1М токенов
Выход
21,81 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
11,97 ₽
по запросам за 30 дней · за 1 млн токенов
StreamLake55 %
12,09 ₽5,44 ₽48,47 ₽21,81 ₽39 т/с99,8 %47,9 %
SiliconFlow
10,17 ₽33,89 ₽19 т/с94,3 %15,8 %
Nebius
11,30 ₽33,89 ₽29 т/с99,3 %10,8 %
CoreWeave
11,30 ₽33,89 ₽11,30 ₽31 т/с97,9 %15,3 %
Alibaba
14,68 ₽58,74 ₽44 т/с100,0 %10,2 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.7 Flash

Qwen3.7 Flash — это модель визуально-языкового рассуждения от Alibaba. Она подходит для мультимодальных агентов, визуального кодирования, поиска и компьютерного взаимодействия, обладая сильными сторонами в распознавании объектов, пространственном понимании и восприятии реального мира.

1.0М контекст·от 3,39 ₽/М

Qwen: Qwen-Audio-3.0-TTS Flash

Qwen-Audio-3.0-TTS Flash — это быстрая и экономичная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

контекст·1 694,39 ₽ за 1М символов

Qwen: Qwen-Audio-3.0-TTS Plus

Qwen-Audio-3.0-TTS Plus — это высококачественная модель преобразования текста в речь от Alibaba, генерирующая озвученный аудиоконтент из текста через API DashScope Speech Synthesizer.

контекст·2 259,18 ₽ за 1М символов

Qwen: Qwen3.7 Plus

Qwen3.7-Plus — это экономичная модель из серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений с текстовым выводом, развивая текстовые возможности серии с комплексным обновлением её визуально-языковых способностей, сохраняя при этом полнофункциональный интеллект агентского уровня для кодирования, использования инструментов и рабочих процессов повышения производительности. Её отличительной чертой является мультимодальная интерактивная гибридная агентская способность: она может воспринимать реальные сцены, читать экраны и взаимодействовать с графическими интерфейсами, генерировать код по визуальным ссылкам и выполнять сквозную навигацию в мобильных приложениях.

1.0М контекст·от 36,15 ₽/М

Qwen: Qwen3.7 Max

Qwen3.7-Max — это флагманская модель в серии Qwen3.7 от Alibaba. Она поддерживает ввод и вывод текста и разработана для рабочих нагрузок, ориентированных на агентов, с особыми преимуществами в кодировании, офисных и продуктивных задачах, а также в автономном выполнении с длительным горизонтом. Модель предлагает заметные улучшения в кодировании и агентском исполнении по сравнению с предыдущими поколениями Qwen и поддерживает явное кэширование prompt для эффективного повторного использования контекста.

1.0М контекст·от 166,61 ₽/М

Qwen: Qwen3 ASR Flash

Qwen3-ASR-Flash — это сервис автоматического распознавания речи от Alibaba, построенный на основе Qwen3-Omni и обученный на десятках миллионов часов мультимодальных речевых данных. Модель поддерживает 11 языков —...

контекст·0,010 ₽ за секунду