DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.
Провайдер для DeepSeek: DeepSeek V4 Pro 0813
Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.
Модальности
Провайдеры
Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.
DeepSeek | 83,40 ₽ | 250,19 ₽ | 2,78 ₽ | — | 100,0 % | < 0,1 % |
Novita−16 % | 62 т/с | 100,0 % | 0,1 % | |||
Baidu−15 % | — | 100,0 % | < 0,1 % | |||
StreamLake−15 % | 57 т/с | 99,9 % | 16,7 % | |||
Alibaba | 141,78 ₽ | 425,33 ₽ | 14,18 ₽ | 46 т/с | 99,1 % | 16,6 % |
GMICloud−15 % | 55 т/с | 99,9 % | 66,1 % | |||
DeepInfra | 164,27 ₽ | 328,54 ₽ | 12,64 ₽ | — | 99,7 % | < 0,1 % |
CoreWeave | 165,53 ₽ | 500,39 ₽ | 5,56 ₽ | — | 99,9 % | < 0,1 % |
NextBit | 166,80 ₽ | 500,39 ₽ | 5,69 ₽ | — | 99,5 % | < 0,1 % |
Sail Research | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | — | 99,9 % | < 0,1 % |
BaseTen | 166,80 ₽ | 500,39 ₽ | 16,68 ₽ | — | 99,8 % | < 0,1 % |
Parasail | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | 57 т/с | 99,7 % | < 0,1 % |
Together | 166,80 ₽ | 500,39 ₽ | 16,43 ₽ | 17 т/с | 99,3 % | 0,4 % |
DigitalOcean | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | — | 99,8 % | < 0,1 % |
SiliconFlow | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | 69 т/с | 100,0 % | 0,1 % |
BaseTen | 166,80 ₽ | 500,39 ₽ | 16,68 ₽ | — | 99,7 % | < 0,1 % |
Cloudflare | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | 36 т/с | 99,7 % | < 0,1 % |
Fireworks | 166,80 ₽ | 500,39 ₽ | 5,56 ₽ | — | 99,8 % | < 0,1 % |
Phala | 183,22 ₽ | 550,93 ₽ | 18,95 ₽ | — | 99,4 % | < 0,1 % |
Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.
Поддерживаемые параметры
Сравнить с…
выбрать любую модель →Другие модели от deepseek
DeepSeek: DeepSeek V4 Flash 0731
DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов.
DeepSeek: DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash Vision Exp — это экспериментальная версия DeepSeek V4 Flash 0731 от DeepSeek с поддержкой зрения, добавляющая понимание изображений при сохранении текстовых возможностей базовой модели, включая агентов, рассуждения и мировые знания. Это разреженная модель mixture-of-experts с 13 миллиардами активных параметров из 284 миллиардов общих. Она подходит для понимания документов и диаграмм, визуальных ответов на вопросы и рабочих процессов мультимодальных агентов, которые чередуют текст и изображения.
DeepSeek: DeepSeek V4 Pro 0813 (batch)
DeepSeek V4 Pro 0813 — это крупномасштабная модель Mixture-of-Experts от DeepSeek. Это общедоступная версия DeepSeek V4 Pro.
DeepSeek V4 Flash Latest
Эта модель всегда перенаправляется на последнюю модель семейства DeepSeek V4 Flash.
DeepSeek: DeepSeek V4 Flash 0731 (batch)
DeepSeek V4 Flash 0731 — это разреженная модель mixture-of-experts от DeepSeek, с 13 миллиардами активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для кодирования, рассуждений и рабочих процессов агентов. Это GA-релиз DeepSeek V4 Flash.
DeepSeek: DeepSeek V4 Pro 0423
DeepSeek V4 Pro — это крупномасштабная модель Mixture-of-Experts от DeepSeek с общим количеством параметров 1,6T и 49B активированных параметров, поддерживающая контекстное окно в 1M токенов. Она разработана для продвинутого рассуждения, кодирования и рабочих процессов агентов с длительным горизонтом, демонстрируя высокую производительность в тестах по знаниям, математике и разработке программного обеспечения. Построенная на той же архитектуре, что и DeepSeek V4 Flash, она представляет гибридную систему attention для эффективной обработки длинного контекста. Поддерживаются уровни рассуждения `high` и `xhigh`; `xhigh` соответствует максимальному уровню рассуждения. Модель хорошо подходит для сложных рабочих нагрузок, таких как анализ всей кодовой базы, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как возможности, так и эффективность.