DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.
Провайдер для DeepSeek: DeepSeek V4 Flash 0731
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Baidu−64 % | 169 т/с | 99,7 % | 28,8 % | |||
OpenInference | 6,32 ₽ | 20,22 ₽ | 1,64 ₽ | — | 99,9 % | < 0,1 % |
Relace | 8,21 ₽ | 22,74 ₽ | 2,02 ₽ | 56 т/с | 98,9 % | 28,7 % |
Sail Research | 8,21 ₽ | 22,74 ₽ | 2,53 ₽ | — | 99,8 % | < 0,1 % |
AkashML | 8,21 ₽ | 22,74 ₽ | 2,02 ₽ | — | 97,4 % | < 0,1 % |
DigitalOcean | 10,11 ₽ | 31,84 ₽ | 3,18 ₽ | 18 т/с | 99,9 % | 1,0 % |
DeepInfra | 10,11 ₽ | 22,74 ₽ | 2,02 ₽ | 32 т/с | 99,4 % | 11,6 % |
StreamLake−80 % | 134 т/с | 99,8 % | 13,8 % | |||
Makora | 11,37 ₽ | 24,64 ₽ | 2,48 ₽ | — | 98,4 % | < 0,1 % |
Wafer | 12,64 ₽ | 31,59 ₽ | 6,32 ₽ | — | 98,8 % | < 0,1 % |
Reka | 13,90 ₽ | 83,40 ₽ | 0,880 ₽ | — | 97,6 % | < 0,1 % |
Morph | 15,60 ₽ | 43,91 ₽ | 3,95 ₽ | — | 95,2 % | < 0,1 % |
BaseTen | 16,43 ₽ | 32,85 ₽ | 3,54 ₽ | — | 97,8 % | < 0,1 % |
BaseTen | 16,43 ₽ | 32,85 ₽ | 3,54 ₽ | — | 97,0 % | < 0,1 % |
Inceptron | 16,43 ₽ | 35,38 ₽ | 3,79 ₽ | — | 99,4 % | < 0,1 % |
CoreWeave | 16,43 ₽ | 35,38 ₽ | 8,85 ₽ | 88 т/с | 100,0 % | 4,1 % |
Together | 17,69 ₽ | 35,38 ₽ | 3,79 ₽ | — | 99,5 % | < 0,1 % |
Parasail | 17,69 ₽ | 35,38 ₽ | 6,32 ₽ | — | 99,7 % | < 0,1 % |
Venice | 22,11 ₽ | 44,23 ₽ | 4,42 ₽ | — | 95,6 % | < 0,1 % |
Mancer 2 | 22,74 ₽ | 63,18 ₽ | — | — | 98,0 % | < 0,1 % |
Fireworks | 27,80 ₽ | 83,40 ₽ | 0,880 ₽ | — | 95,8 % | < 0,1 % |
SiliconFlow | 27,80 ₽ | 83,40 ₽ | 3,54 ₽ | — | 99,8 % | < 0,1 % |
DeepSeek | 27,80 ₽ | 83,40 ₽ | 0,880 ₽ | — | 100,0 % | < 0,1 % |
Alibaba | 44,48 ₽ | 133,44 ₽ | 4,45 ₽ | — | 99,7 % | < 0,1 % |
GMICloud−20 % | 61 т/с | 69,7 % | 4,6 % | |||
NextBit | 50,54 ₽ | 151,63 ₽ | 1,26 ₽ | — | 99,8 % | < 0,1 % |
Novita−7 % | — | 100,0 % | < 0,1 % | |||
Phala | 55,60 ₽ | 166,80 ₽ | 3,54 ₽ | — | 91,3 % | < 0,1 % |
AtlasCloud | 55,60 ₽ | 166,80 ₽ | 3,54 ₽ | — | 99,8 % | < 0,1 % |
Cloudflare | 55,60 ₽ | 166,80 ₽ | 1,77 ₽ | — | 99,9 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от deepseek
DeepSeek: DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 от DeepSeek с поддержкой зрения, добавляющая понимание изображений при сохранении текстовых возможностей базовой модели, включая агентов, рассуждения и мировые знания. Это разреженная модель mixture-of-experts с 13 миллиардами активных параметров из 284 миллиардов общих. Она подходит для понимания документов и диаграмм, визуальных ответов на вопросы и рабочих процессов мультимодальных агентов, которые чередуют текст и изображения.
DeepSeek: DeepSeek V4 Pro 0813
DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.
DeepSeek: DeepSeek V4 Pro 0813 (batch)
DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.
DeepSeek V4 Flash Latest
Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek V4 Flash.
DeepSeek: DeepSeek V4 Flash 0731 (batch)
DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek, с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов. Это GA-релиз DeepSeek V4 Flash.
DeepSeek: DeepSeek V4 Pro 0423
DeepSeek V4 Pro — это крупномасштабная модель Mixture-of-Experts от DeepSeek с общим количеством параметров 1,6T и 49B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для продвинутого рассуждения, кодирования и рабочих процессов агентов с длительным горизонтом, демонстрируя высокую производительность в тестах по знаниям, математике и разработке программного обеспечения. Построенная на той же архитектуре, что и DeepSeek V4 Flash, она представляет гибридную систему attention для эффективной обработки длинного контекста. Поддерживаются уровни рассуждения `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждения. Модель хорошо подходит для сложных рабочих нагрузок, таких как анализ всей кодовой базы, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как возможности, так и эффективность.