hubris
Логотип DeepSeek — провайдер модели DeepSeek: DeepSeek V3.1

DeepSeek: DeepSeek V3.1

deepseek/deepseek-chat-v3.1
deepseek
Выпущена 21 августа 2025 г.|164К контекст|31,59 ₽/М вход|120,04 ₽/М выход

DeepSeek-V3.1 — это большая гибридная модель рассуждений (671B параметров, 37B активных), которая поддерживает как режимы мышления, так и не-мышления с помощью шаблонов prompt. Она расширяет базовую модель DeepSeek-V3 двухфазным процессом обучения на длинных контекстах, достигая до 128K токенов, и использует микромасштабирование FP8 для эффективного вывода. Пользователи могут управлять поведением рассуждений с помощью логического параметра reasoning enabled.

Модель улучшает использование инструментов, генерацию кода и эффективность рассуждений, достигая производительности, сравнимой с DeepSeek-R1 на сложных бенчмарках, при этом отвечая быстрее. Она поддерживает структурированный вызов инструментов, кодовых агентов и поисковых агентов, что делает ее подходящей для исследований, кодирования и агентских рабочих процессов.

Она является преемником модели DeepSeek V3-0324 и хорошо справляется с различными задачами.

Провайдер для DeepSeek: DeepSeek V3.1

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

deepseek
Контекст
164К
токенов
Макс. ответ
33К
токенов
Вход
31,59 ₽
за 1М токенов
Выход
120,04 ₽
за 1М токенов
Кеш чтение
16,43 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
94,55 ₽
по запросам за 30 дней · за 1 млн токенов
DeepInfra
31,59 ₽120,04 ₽16,43 ₽9 т/с99,7 %18,8 %
Novita
34,12 ₽126,36 ₽17,06 ₽22 т/с100,0 %24,3 %
SiliconFlow
34,12 ₽126,36 ₽17 т/с92,4 %23,8 %
AtlasCloud
37,91 ₽120,04 ₽16,43 ₽45 т/с98,6 %16,3 %
CoreWeave
69,50 ₽208,50 ₽69,50 ₽42 т/с100,0 %6,2 %
Google
75,82 ₽214,81 ₽60 т/с96,6 %3,5 %
Mara
75,82 ₽214,81 ₽23 т/с97,8 %1,9 %
SambaNova
82,13 ₽189,54 ₽69 т/с98,3 %5,3 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от deepseek

DeepSeek: DeepSeek V4 Flash 0423

DeepSeek V4 Flash — это оптимизированная по эффективности модель Mixture-of-Experts от DeepSeek с общим количеством параметров 284B и 13B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для быстрого инференса и высокопроизводительных рабочих нагрузок, сохраняя при этом высокую производительность в рассуждениях и кодировании. Модель включает гибридный механизм attention для эффективной обработки длинного контекста. Поддерживаются уровни рассуждений `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждений. Она хорошо подходит для таких приложений, как помощники по кодированию, чат-системы и рабочие процессы агентов, где важны скорость отклика и экономическая эффективность.

1.0М контекст·от 10,08 ₽/М

DeepSeek: DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.

1.0М контекст·от 83,40 ₽/М

DeepSeek V4 Flash Latest

Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek V4 Flash.

1.3М контекст·от 9,93 ₽/М

DeepSeek: DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.

1.3М контекст·от 17,69 ₽/М

DeepSeek: DeepSeek V4 Pro 0423

DeepSeek V4 Pro — это крупномасштабная модель Mixture-of-Experts от DeepSeek с общим количеством параметров 1,6T и 49B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для продвинутого рассуждения, кодирования и рабочих процессов агентов с длительным горизонтом, демонстрируя высокую производительность в тестах по знаниям, математике и разработке программного обеспечения. Построенная на той же архитектуре, что и DeepSeek V4 Flash, она представляет гибридную систему attention для эффективной обработки длинного контекста. Поддерживаются уровни рассуждения `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждения. Модель хорошо подходит для сложных рабочих нагрузок, таких как анализ всей кодовой базы, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как возможности, так и эффективность.

1.0М контекст·от 83,40 ₽/М

DeepSeek: DeepSeek V3.2

DeepSeek-V3.2 — это большая языковая модель, разработанная для гармоничного сочетания высокой вычислительной эффективности с мощными возможностями рассуждений и использования инструментов в качестве агента. Она представляет DeepSeek Sparse Attention (DSA), мелкозернистый механизм разреженного внимания, который снижает затраты на обучение и инференс, сохраняя при этом качество в сценариях с длинным контекстом. Масштабируемая структура пост-обучения с подкреплением дополнительно улучшает рассуждения, демонстрируя производительность класса GPT-5, и модель показала золотые результаты на IMO и IOI 2025 года. V3.2 также использует крупномасштабный конвейер синтеза агентских задач для лучшей интеграции рассуждений в настройки использования инструментов, повышая соответствие и обобщение в интерактивных средах. Пользователи могут управлять поведением рассуждений с помощью булевого параметра `reasoning` `enabled`.

164К контекст·от 33,99 ₽/М