DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.
Провайдер для DeepSeek: DeepSeek V4 Flash 0731
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
Inceptron | 7,04 ₽ | 22,31 ₽ | 1,11 ₽ | — | 90,6 % | < 0,1 % |
StreamLake−86 % | 103 т/с | 97,6 % | 13,5 % | |||
Relace | 7,57 ₽ | 15,15 ₽ | 1,51 ₽ | 50 т/с | 99,7 % | 43,3 % |
DeepInfra | 7,57 ₽ | 22,72 ₽ | 1,89 ₽ | 37 т/с | 99,8 % | 10,0 % |
Sail Research | 9,35 ₽ | 43,17 ₽ | 2,88 ₽ | — | 96,5 % | < 0,1 % |
Sail Research | 9,35 ₽ | 43,17 ₽ | 2,88 ₽ | — | 96,7 % | < 0,1 % |
Makora | 11,36 ₽ | 24,62 ₽ | 2,47 ₽ | 30 т/с | 99,1 % | 1,3 % |
Wafer | 12,62 ₽ | 31,56 ₽ | 6,31 ₽ | 42 т/с | 99,9 % | 4,5 % |
Reka | 13,89 ₽ | 83,32 ₽ | 0,880 ₽ | — | 99,8 % | < 0,1 % |
DigitalOcean | 15,02 ₽ | 30,04 ₽ | 3,00 ₽ | — | 99,9 % | < 0,1 % |
BaseTen | 16,41 ₽ | 32,82 ₽ | 3,53 ₽ | — | 99,9 % | < 0,1 % |
BaseTen | 16,41 ₽ | 32,82 ₽ | 3,53 ₽ | — | 99,9 % | < 0,1 % |
CoreWeave | 16,41 ₽ | 35,35 ₽ | 8,84 ₽ | 116 т/с | 100,0 % | 2,3 % |
Together | 17,67 ₽ | 35,35 ₽ | 3,79 ₽ | — | 99,7 % | < 0,1 % |
Parasail | 17,67 ₽ | 35,35 ₽ | 6,31 ₽ | — | 99,7 % | < 0,1 % |
Morph | 17,92 ₽ | 50,45 ₽ | 4,54 ₽ | — | 98,0 % | < 0,1 % |
Venice | 22,09 ₽ | 44,18 ₽ | 4,42 ₽ | — | 99,5 % | < 0,1 % |
Mancer 2 | 25,25 ₽ | 75,74 ₽ | — | — | 99,4 % | < 0,1 % |
Fireworks | 27,77 ₽ | 83,32 ₽ | 0,880 ₽ | — | 97,4 % | < 0,1 % |
SiliconFlow | 27,77 ₽ | 83,32 ₽ | 3,53 ₽ | — | 99,6 % | < 0,1 % |
GMICloud−35 % | 68 т/с | 99,9 % | 1,4 % | |||
NextBit | 44,44 ₽ | 133,31 ₽ | 1,51 ₽ | — | 99,1 % | < 0,1 % |
Alibaba | 44,44 ₽ | 133,31 ₽ | 4,44 ₽ | — | 100,0 % | < 0,1 % |
Novita−7 % | — | 100,0 % | < 0,1 % | |||
Phala | 55,54 ₽ | 166,63 ₽ | 3,53 ₽ | — | 99,7 % | < 0,1 % |
Baidu | 55,54 ₽ | 166,63 ₽ | 1,77 ₽ | 171 т/с | 100,0 % | 18,2 % |
AtlasCloud | 55,54 ₽ | 166,63 ₽ | 3,53 ₽ | — | 99,9 % | < 0,1 % |
Cloudflare | 55,54 ₽ | 166,63 ₽ | 1,77 ₽ | — | 100,0 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от deepseek
DeepSeek: DeepSeek V4.1 Flash
DeepSeek V4.1 Flash — это разреженная модель Mixture-of-Experts от DeepSeek, представляющая собой экономичный уровень семейства V4.1. DeepSeek сообщает, что она превосходит V4 Pro по производительности, скорости и времени выполнения задач, поэтому она находится выше предыдущего флагмана, а не ниже. Она подходит для кодирования, рассуждений и агентских рабочих процессов, и особенно сильна в долгосрочных задачах, которые должны быть выполнены до конца за множество шагов.
DeepSeek: DeepSeek V4 Pro 0813
DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.
DeepSeek: DeepSeek V3
DeepSeek-V3 — это новейшая модель от команды DeepSeek, основанная на возможностях следования инструкциям и написания кода предыдущих версий. Предварительно обученная на почти 15 триллионах токенов, согласно опубликованным оценкам, модель превосходит другие модели с открытым исходным кодом и конкурирует с ведущими моделями с закрытым исходным кодом. Для получения подробной информации о модели, пожалуйста, посетите [репозиторий DeepSeek-V3](https://github.com/deepseek-ai/DeepSeek-V3) или ознакомьтесь с [анонсом запуска](https://api-docs.deepseek.com/news/news1226).
DeepSeek: DeepSeek V3.2
DeepSeek-V3.2 — это большая языковая модель, разработанная для гармоничного сочетания высокой вычислительной эффективности с мощными возможностями рассуждений и использования инструментов в качестве агента. Она представляет DeepSeek Sparse Attention (DSA), мелкозернистый механизм разреженного внимания, который снижает затраты на обучение и инференс, сохраняя при этом качество в сценариях с длинным контекстом. Масштабируемая структура пост-обучения с подкреплением дополнительно улучшает рассуждения, демонстрируя производительность класса GPT-5, и модель показала золотые результаты на IMO и IOI 2025 года. V3.2 также использует крупномасштабный конвейер синтеза агентских задач для лучшей интеграции рассуждений в настройки использования инструментов, повышая соответствие и обобщение в интерактивных средах. Пользователи могут управлять поведением рассуждений с помощью булевого параметра `reasoning` `enabled`.
DeepSeek: DeepSeek Pro Latest
Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek Pro.
DeepSeek: DeepSeek Flash Latest
Эта модель всегда перенаправляется на новейшую модель семейства DeepSeek Flash.