hubris
Логотип DeepSeek — провайдер модели DeepSeek: DeepSeek V4 Flash 0731

DeepSeek: DeepSeek V4 Flash 0731

Популярная
deepseek/deepseek-v4-flash-0731
deepseek
Выпущена 31 июля 2026 г.|1.3М контекст|8,21 ₽/М вход|22,74 ₽/М выход

DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.

Провайдер для DeepSeek: DeepSeek V4 Flash 0731

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

deepseek
Контекст
1.3М
токенов
Макс. ответ
944К
токенов
Вход
8,21 ₽
за 1М токенов
Выход
22,74 ₽
за 1М токенов
Кеш чтение
2,02 ₽
за 1М токенов

Модальности

Вход:ТекстВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
3,53 ₽
по запросам за 30 дней · за 1 млн токенов
Baidu64 %
17,56 ₽6,32 ₽35,08 ₽12,63 ₽3,50 ₽1,26 ₽169 т/с99,7 %28,8 %
OpenInference
6,32 ₽20,22 ₽1,64 ₽99,9 %< 0,1 %
Relace
8,21 ₽22,74 ₽2,02 ₽56 т/с98,9 %28,7 %
Sail Research
8,21 ₽22,74 ₽2,53 ₽99,8 %< 0,1 %
AkashML
8,21 ₽22,74 ₽2,02 ₽97,4 %< 0,1 %
DigitalOcean
10,11 ₽31,84 ₽3,18 ₽18 т/с99,9 %1,0 %
DeepInfra
10,11 ₽22,74 ₽2,02 ₽32 т/с99,4 %11,6 %
StreamLake80 %
55,60 ₽11,12 ₽166,80 ₽33,36 ₽1,75 ₽0,350 ₽134 т/с99,8 %13,8 %
Makora
11,37 ₽24,64 ₽2,48 ₽98,4 %< 0,1 %
Wafer
12,64 ₽31,59 ₽6,32 ₽98,8 %< 0,1 %
Reka
13,90 ₽83,40 ₽0,880 ₽97,6 %< 0,1 %
Morph
15,60 ₽43,91 ₽3,95 ₽95,2 %< 0,1 %
BaseTen
16,43 ₽32,85 ₽3,54 ₽97,8 %< 0,1 %
BaseTen
16,43 ₽32,85 ₽3,54 ₽97,0 %< 0,1 %
Inceptron
16,43 ₽35,38 ₽3,79 ₽99,4 %< 0,1 %
CoreWeave
16,43 ₽35,38 ₽8,85 ₽88 т/с100,0 %4,1 %
Together
17,69 ₽35,38 ₽3,79 ₽99,5 %< 0,1 %
Parasail
17,69 ₽35,38 ₽6,32 ₽99,7 %< 0,1 %
Venice
22,11 ₽44,23 ₽4,42 ₽95,6 %< 0,1 %
Mancer 2
22,74 ₽63,18 ₽98,0 %< 0,1 %
Fireworks
27,80 ₽83,40 ₽0,880 ₽95,8 %< 0,1 %
SiliconFlow
27,80 ₽83,40 ₽3,54 ₽99,8 %< 0,1 %
DeepSeek
27,80 ₽83,40 ₽0,880 ₽100,0 %< 0,1 %
Alibaba
44,48 ₽133,44 ₽4,45 ₽99,7 %< 0,1 %
GMICloud20 %
55,60 ₽44,48 ₽166,80 ₽133,44 ₽1,78 ₽1,42 ₽61 т/с69,7 %4,6 %
NextBit
50,54 ₽151,63 ₽1,26 ₽99,8 %< 0,1 %
Novita7 %
55,60 ₽51,71 ₽166,80 ₽155,12 ₽3,54 ₽3,29 ₽100,0 %< 0,1 %
Phala
55,60 ₽166,80 ₽3,54 ₽91,3 %< 0,1 %
AtlasCloud
55,60 ₽166,80 ₽3,54 ₽99,8 %< 0,1 %
Cloudflare
55,60 ₽166,80 ₽1,77 ₽99,9 %< 0,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

Другие модели от deepseek

DeepSeek: DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 от DeepSeek с поддержкой зрения, добавляющая понимание изображений при сохранении текстовых возможностей базовой модели, включая агентов, рассуждения и мировые знания. Это разреженная модель mixture-of-experts с 13 миллиардами активных параметров из 284 миллиардов общих. Она подходит для понимания документов и диаграмм, визуальных ответов на вопросы и рабочих процессов мультимодальных агентов, которые чередуют текст и изображения.

1.0М контекст·от 27,80 ₽/М

DeepSeek: DeepSeek V4 Pro 0813

DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.

1.0М контекст·от 141,61 ₽/М

DeepSeek: DeepSeek V4 Pro 0813 (batch)

DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.

1.0М контекст·от 166,80 ₽/М

DeepSeek V4 Flash Latest

Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek V4 Flash.

1.3М контекст·от 6,32 ₽/М

DeepSeek: DeepSeek V4 Flash 0731 (batch)

DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek, с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов. Это GA-релиз DeepSeek V4 Flash.

1.0М контекст·от 17,69 ₽/М

DeepSeek: DeepSeek V4 Pro 0423

DeepSeek V4 Pro — это крупномасштабная модель Mixture-of-Experts от DeepSeek с общим количеством параметров 1,6T и 49B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для продвинутого рассуждения, кодирования и рабочих процессов агентов с длительным горизонтом, демонстрируя высокую производительность в тестах по знаниям, математике и разработке программного обеспечения. Построенная на той же архитектуре, что и DeepSeek V4 Flash, она представляет гибридную систему attention для эффективной обработки длинного контекста. Поддерживаются уровни рассуждения `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждения. Модель хорошо подходит для сложных рабочих нагрузок, таких как анализ всей кодовой базы, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как возможности, так и эффективность.

1.0М контекст·от 113,78 ₽/М