hubris
Логотип DeepSeek — провайдер модели DeepSeek: DeepSeek V4 Flash 0731

DeepSeek: DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
deepseek
Выпущена 31 июля 2026 г.|1.3М контекст|7,57 ₽/М вход|15,15 ₽/М выход

DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.

Провайдер для DeepSeek: DeepSeek V4 Flash 0731

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

deepseek
Контекст
1.3М
токенов
Макс. ответ
944К
токенов
Вход
7,57 ₽
за 1М токенов
Выход
15,15 ₽
за 1М токенов
Кеш чтение
1,51 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
3,18 ₽
по запросам за 30 дней · за 1 млн токенов
Inceptron
7,04 ₽22,31 ₽1,11 ₽90,6 %< 0,1 %
StreamLake86 %
53,71 ₽7,52 ₽161,14 ₽22,56 ₽1,71 ₽0,240 ₽103 т/с97,6 %13,5 %
Relace
7,57 ₽15,15 ₽1,51 ₽50 т/с99,7 %43,3 %
DeepInfra
7,57 ₽22,72 ₽1,89 ₽37 т/с99,8 %10,0 %
Sail Research
9,35 ₽43,17 ₽2,88 ₽96,5 %< 0,1 %
Sail Research
9,35 ₽43,17 ₽2,88 ₽96,7 %< 0,1 %
Makora
11,36 ₽24,62 ₽2,47 ₽30 т/с99,1 %1,3 %
Wafer
12,62 ₽31,56 ₽6,31 ₽42 т/с99,9 %4,5 %
Reka
13,89 ₽83,32 ₽0,880 ₽99,8 %< 0,1 %
DigitalOcean
15,02 ₽30,04 ₽3,00 ₽99,9 %< 0,1 %
BaseTen
16,41 ₽32,82 ₽3,53 ₽99,9 %< 0,1 %
BaseTen
16,41 ₽32,82 ₽3,53 ₽99,9 %< 0,1 %
CoreWeave
16,41 ₽35,35 ₽8,84 ₽116 т/с100,0 %2,3 %
Together
17,67 ₽35,35 ₽3,79 ₽99,7 %< 0,1 %
Parasail
17,67 ₽35,35 ₽6,31 ₽99,7 %< 0,1 %
Morph
17,92 ₽50,45 ₽4,54 ₽98,0 %< 0,1 %
Venice
22,09 ₽44,18 ₽4,42 ₽99,5 %< 0,1 %
Mancer 2
25,25 ₽75,74 ₽99,4 %< 0,1 %
Fireworks
27,77 ₽83,32 ₽0,880 ₽97,4 %< 0,1 %
SiliconFlow
27,77 ₽83,32 ₽3,53 ₽99,6 %< 0,1 %
GMICloud35 %
55,54 ₽36,10 ₽166,63 ₽108,31 ₽1,77 ₽1,15 ₽68 т/с99,9 %1,4 %
NextBit
44,44 ₽133,31 ₽1,51 ₽99,1 %< 0,1 %
Alibaba
44,44 ₽133,31 ₽4,44 ₽100,0 %< 0,1 %
Novita7 %
55,55 ₽51,66 ₽166,63 ₽154,97 ₽3,54 ₽3,29 ₽100,0 %< 0,1 %
Phala
55,54 ₽166,63 ₽3,53 ₽99,7 %< 0,1 %
Baidu
55,54 ₽166,63 ₽1,77 ₽171 т/с100,0 %18,2 %
AtlasCloud
55,54 ₽166,63 ₽3,53 ₽99,9 %< 0,1 %
Cloudflare
55,54 ₽166,63 ₽1,77 ₽100,0 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

Другие модели от deepseek

DeepSeek: DeepSeek V4.1 Flash

DeepSeek V4.1 Flash — это разреженная модель Mixture-of-Experts от DeepSeek, представляющая собой экономичный уровень семейства V4.1. DeepSeek сообщает, что она превосходит V4 Pro по производительности, скорости и времени выполнения задач, поэтому она находится выше предыдущего флагмана, а не ниже. Она подходит для кодирования, рассуждений и агентских рабочих процессов, и особенно сильна в долгосрочных задачах, которые должны быть выполнены до конца за множество шагов.

1.0М контекст·от 37,87 ₽/М

DeepSeek: DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.

1.0М контекст·от 166,63 ₽/М

DeepSeek: DeepSeek V3

DeepSeek-V3 — это новейшая модель от команды DeepSeek, основанная на возможностях следования инструкциям и написания кода предыдущих версий. Предварительно обученная на почти 15 триллионах токенов, согласно опубликованным оценкам, модель превосходит другие модели с открытым исходным кодом и конкурирует с ведущими моделями с закрытым исходным кодом. Для получения подробной информации о модели, пожалуйста, посетите [репозиторий DeepSeek-V3](https://github.com/deepseek-ai/DeepSeek-V3) или ознакомьтесь с [анонсом запуска](https://api-docs.deepseek.com/news/news1226).

164К контекст·от 40,40 ₽/М

DeepSeek: DeepSeek V3.2

DeepSeek-V3.2 — это большая языковая модель, разработанная для гармоничного сочетания высокой вычислительной эффективности с мощными возможностями рассуждений и использования инструментов в качестве агента. Она представляет DeepSeek Sparse Attention (DSA), мелкозернистый механизм разреженного внимания, который снижает затраты на обучение и инференс, сохраняя при этом качество в сценариях с длинным контекстом. Масштабируемая структура пост-обучения с подкреплением дополнительно улучшает рассуждения, демонстрируя производительность класса GPT-5, и модель показала золотые результаты на IMO и IOI 2025 года. V3.2 также использует крупномасштабный конвейер синтеза агентских задач для лучшей интеграции рассуждений в настройки использования инструментов, повышая соответствие и обобщение в интерактивных средах. Пользователи могут управлять поведением рассуждений с помощью булевого параметра `reasoning` `enabled`.

164К контекст·от 33,96 ₽/М

DeepSeek: DeepSeek Pro Latest

Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek Pro.

1.0М контекст·от 88,37 ₽/М

DeepSeek: DeepSeek Flash Latest

Эта модель всегда перенаправляется на новейшую модель семейства DeepSeek Flash.

1.0М контекст·от 17,04 ₽/М