hubris
Логотип Qwen — провайдер модели Qwen: Qwen3 Coder Next

Qwen: Qwen3 Coder Next

qwen/qwen3-coder-next
qwen
Выпущена 4 февраля 2026 г.|262К контекст|15,15 ₽/М вход|100,99 ₽/М выход

Qwen3-Coder-Next — это причинная языковая модель с открытым весом, оптимизированная для кодирующих агентов и локальных рабочих процессов разработки. Она использует разреженную MoE-архитектуру с общим количеством параметров 80B и всего 3B активированными на токен, обеспечивая производительность, сравнимую с моделями, требующими в 10–20 раз больше активных вычислений, что делает ее хорошо подходящей для экономичных, постоянно работающих развертываний агентов.

Модель обучена с сильным акцентом на агентность и надежно работает в задачах кодирования с длительным горизонтом, сложном использовании инструментов и восстановлении после сбоев выполнения. Благодаря нативному окну контекста 256k, она легко интегрируется в реальные среды CLI и IDE и хорошо адаптируется к общим каркасам агентов, используемым современными инструментами кодирования. Модель работает исключительно в режиме без размышлений и не выдает блоки <think>, что упрощает интеграцию для производственных кодирующих агентов.

Провайдер для Qwen: Qwen3 Coder Next

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

qwen
Контекст
262К
токенов
Макс. ответ
236К
токенов
Вход
15,15 ₽
за 1М токенов
Выход
100,99 ₽
за 1М токенов
Кеш чтение
8,84 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
13,06 ₽
по запросам за 30 дней · за 1 млн токенов
Parasail
15,15 ₽100,99 ₽8,84 ₽72 т/с100,0 %51,3 %
StreamLake40 %
37,87 ₽22,72 ₽189,35 ₽113,61 ₽7,57 ₽4,54 ₽43 т/с98,9 %44,9 %
Novita
25,25 ₽189,35 ₽99,5 %< 0,1 %
Alibaba
37,87 ₽189,35 ₽2,8 т/с99,2 %3,7 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от qwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 — это обновленный снимок Qwen3.8 Max от команды Qwen из Alibaba. Это модель Mixture-of-Experts с 2,4 триллионами параметров, которая принимает текстовые, графические и видеовходы и возвращает текст, с окном контекста в 1 миллион токенов и включенным по умолчанию механизмом рассуждений. Этот снимок прошел пост-обучение для кодирования и агентской работы, включая многоэтапные программные проекты, оркестрацию нескольких инструментов и выполнение долгосрочных задач. Он также предназначен для анализа диаграмм, парсинга документов и мультимодального понимания больших документов и расширенного видео. Поддерживаются вызовы инструментов, структурированные выводы и настраиваемое усилие рассуждений.

1.0М контекст·от 252,47 ₽/М

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в кодировании, агентских рабочих процессов, визуального понимания, анализа документов и кодовых баз, взаимодействия с рабочим столом, анализа диаграмм и анализа длинных видео.

1.0М контекст·от 18,94 ₽/М

Qwen: Qwen3.8 27B (free)

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

262К контекст·бесплатно

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая плотная визуально-языковая модель от Qwen. Она подходит для кодирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, с гибким мышлением, которое можно включать или отключать.

1.0М контекст·от 27,01 ₽/М

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B — это модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию на 30 языках и 22 китайских диалектах, с потоковым и офлайн-выводом...

контекст·0,010 ₽ за секунду

Qwen: Qwen3 ASR 0.6B

Qwen3 ASR 0.6B — это компактная модель автоматического распознавания речи от Qwen. Она поддерживает многоязычную идентификацию и транскрипцию речи на 30 языках и 22 китайских диалектах, с потоковой и офлайн-обработкой...

контекст·0,010 ₽ за секунду