DeepSeek
·Released on 12 авг. 2026 г.

DeepSeek V4 Pro 0813 API Benchmarks, Pricing & Provider Data

Compare DeepSeek V4 Pro 0813 with another model

Choose a model to open its comparison page.

Share on X
LLM

DeepSeek V4 Pro 0813 is a large-scale mixture-of-experts model from DeepSeek. This is the GA release of DeepSeek V4 Pro.

Качество
#26of 100
67.0
Оценка LMSpeed

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
6 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты57.5Программирование57.1Рассуждение61Знания58.4Математика58.9Многоязычность-Мультимодальность-Следование инструкциям54.9
#1Рассуждение61РейтинговаяОбщий рейтинг #23/4 Измеренные измерения
80% интервал: 52.669.3
abstract logicТолько априорное
scientific causal62.7
critpt · critpt / gpqa · aa_gpqa_diamond / hle · aa_hle
multistep constraints59
mmlu_pro · mmlu_pro
evidence verification61.1
lcr · lcr / mrcr · mrcr1m
#2Математика58.9Оценка2/4 Измеренные измерения
80% интервал: 46.871.1
foundational mathТолько априорное
competition math61.7
hmmt · hmmt_feb2026
proof frontier56.2
imo · imo_answer_bench
applied tool mathТолько априорное
#3Знания58.4Предварительная1/4 Измеренные измерения
80% интервал: 40.476.5
broad knowledgeТолько априорное
professional knowledgeТолько априорное
factuality58.4
simpleqa · simple_qa
retrieval open bookТолько априорное
#4Агенты57.5РейтинговаяОбщий рейтинг #133/4 Измеренные измерения
80% интервал: 49.865.2
planningТолько априорное
tool use58.1
mcp_atlas · mcp_atlas / tau · aa_tau3_banking / tau · tau2_bench / toolathlon · toolathlon
environment execution55.9
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability58.6
apex_agents · apex_agents_aa / cyber_gym · cyber_gym
#5Программирование57.1РейтинговаяОбщий рейтинг #104/4 Измеренные измерения
80% интервал: 50.963.2
code generation58.5
scicode · aa_sci_code
repository engineering62.4
nl2repo · nl2_repo / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing56.9
swe_multilingual · benchlm_coding_swe_multilingual / swe_verified · swe_verified
tooling quality50.5
terminalbench · aa_terminal_bench21 / terminalbench · benchlm_coding_terminal_bench2
#6Следование инструкциям54.9Предварительная1/4 Измеренные измерения
80% интервал: 38.970.9
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization54.9
ifbench · aa_if_bench
long multiturn instructionТолько априорное
Нет данных:МногоязычностьМультимодальность

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
384Ktokens
8K128K1M4M
1.0M

Возможности

Technical Details

Вход
Выход
Выпущена
Aug 2026
Документация
Токенизатор
DeepSeek
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Rankings

Excels at

It's decent at

Falls behind in

Подробные оценки

Обновлено: 23 авг. 2026 г.

Общее

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Overall score67.0#26 / 100DeepSWE62.7#8 / 16
Overall score
Рейтинг LMSpeed#26
Оценка67.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
DeepSWE
Рейтинг LMSpeed#8
Оценка62.7
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка57.5#1380% интервал49.8–65.23/4 Измеренные измеренияAgentic score68.2#25 / 69Terminal-Bench 2.067.9#20 / 53
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментов58.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mcp_atlas · mcp_atlas · z 0.04 · q 1.00
tau · aa_tau3_banking · z 0.59 · q 1.00
tau · tau2_bench · z 0.77 · q 1.00
toolathlon · toolathlon · z 0.38 · q 1.00
Среда и длительное выполнение55.9
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
browsecomp · browse_comp · z 0.28 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.40 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.27 · q 1.00
Восстановление и надёжность завершения58.6
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
apex_agents · apex_agents_aa · z -0.04 · q 1.00
cyber_gym · cyber_gym · z 0.72 · q 1.00
Agentic score
Рейтинг LMSpeed#25
Оценка68.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Terminal-Bench 2.0Доказательство V3
Рейтинг LMSpeed#20
Оценка67.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
BrowseCompДоказательство V3
Рейтинг LMSpeed#12
Оценка83.4
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
HLE w/ tools
Рейтинг LMSpeed#2
Оценка60.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
MCP AtlasДоказательство V3
Рейтинг LMSpeed#16
Оценка73.6
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
ToolathlonДоказательство V3
Рейтинг LMSpeed#9
Оценка51.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Terminal-Bench 2.1
Рейтинг LMSpeed#1
Оценка87.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
CyberGymДоказательство V3
Рейтинг LMSpeed#2
Оценка83.3
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Toolathlon-Verified
Рейтинг LMSpeed#2
Оценка74.1
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Agents' Last Exam
Рейтинг LMSpeed#4
Оценка25.7
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AutomationBench
Рейтинг LMSpeed#1
Оценка31.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
GDPval-AAДоказательство V3
Рейтинг LMSpeed#22
Оценка1306.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA Agentic Index
Рейтинг LMSpeed#9
Оценка49.6
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
APEX-Agents-AAДоказательство V3
Рейтинг LMSpeed#13
Оценка24.3
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Τ²-bench resultsДоказательство V3
Рейтинг LMSpeed#12
Оценка96.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
GDPval-AA
Рейтинг LMSpeed#9
Оценка54.5
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA Tau3 BankingДоказательство V3
Рейтинг LMSpeed#6
Оценка39.6
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка57.1#1080% интервал50.9–63.24/4 Измеренные измеренияCoding score57.6#36 / 81Codeforces3206.0#1 / 4
Измерения и доказательства
Генерация кода58.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
scicode · aa_sci_code · z 0.99 · q 1.00
Работа с репозиториями62.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
nl2repo · nl2_repo · z 3.00 · q 1.00
swe_pro · swe_pro · z -0.26 · q 1.00
vibecode · vibe_code_bench · z 0.86 · q 1.00
Отладка и тестирование56.9
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
swe_multilingual · benchlm_coding_swe_multilingual · z 0.30 · q 1.00
swe_verified · swe_verified · z 0.80 · q 1.00
Инструментальная разработка и качество50.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
terminalbench · aa_terminal_bench21 · z -0.10 · q 1.00
terminalbench · benchlm_coding_terminal_bench2 · z 0.00 · q 1.00
Coding score
Рейтинг LMSpeed#36
Оценка57.6
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Codeforces
Рейтинг LMSpeed#1
Оценка3206.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
SWE-bench VerifiedДоказательство V3
Рейтинг LMSpeed#9
Оценка80.6
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
SWE-bench ProДоказательство V3
Рейтинг LMSpeed#33
Оценка55.4
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
SWE MultilingualДоказательство V3
Рейтинг LMSpeed#10
Оценка76.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Terminal-Bench 2.0Доказательство V3
Рейтинг LMSpeed#17
Оценка67.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
LiveCodeBench Pass@1-COT
Рейтинг LMSpeed#1
Оценка93.5
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Terminal-Bench 2.1
Рейтинг LMSpeed#1
Оценка87.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
NL2RepoДоказательство V3
Рейтинг LMSpeed#1
Оценка61.5
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
DSBench-FullStack
Рейтинг LMSpeed#1
Оценка71.1
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
DSBench-Hard
Рейтинг LMSpeed#1
Оценка67.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Vibe Code BenchДоказательство V3
Рейтинг LMSpeed#8
Оценка49.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA Coding Index
Рейтинг LMSpeed#21
Оценка68.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#32
Оценка49.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA Terminal-Bench 2.1Доказательство V3
Рейтинг LMSpeed#10
Оценка78.7
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка61#280% интервал52.6–69.33/4 Измеренные измеренияMMLU-Pro87.5%#9 / 129GPQA90.1%#28 / 211
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение62.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z 0.83 · q 1.00
gpqa · aa_gpqa_diamond · z 1.27 · q 1.00
hle · aa_hle · z 0.95 · q 1.00
Многошаговые ограничения59
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z 1.00 · q 1.00
Интеграция и проверка свидетельств61.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z 0.36 · q 1.00
mrcr · mrcr1m · z 1.52 · q 0.75
MMLU-ProДоказательство V3
Рейтинг LMSpeed#9
Оценка87.5%
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
GPQAДоказательство V3
Рейтинг LMSpeed#28
Оценка90.1%
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
HLEДоказательство V3
Рейтинг LMSpeed#16
Оценка42.7%
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
MRCR 1MДоказательство V3
Рейтинг LMSpeed#1
Оценка83.5
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
CorpusQA 1M
Рейтинг LMSpeed#1
Оценка62.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-LCRДоказательство V3
Рейтинг LMSpeed#25
Оценка75.3
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
CritPtДоказательство V3
Рейтинг LMSpeed#14
Оценка18.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка58.480% интервал40.4–76.51/4 Измеренные измеренияKnowledge score77.0#20 / 69SimpleQA57.9#1 / 4
Измерения и доказательства
Широкие знанияТолько априорное
Профессиональные знанияТолько априорное
Фактологичность58.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
simpleqa · simple_qa · z 1.39 · q 0.17
Поиск и открытые источникиТолько априорное
Knowledge score
Рейтинг LMSpeed#20
Оценка77.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
SimpleQAДоказательство V3
Рейтинг LMSpeed#1
Оценка57.9
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Chinese-SimpleQA
Рейтинг LMSpeed#1
Оценка84.4
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
GPQA-D
Рейтинг LMSpeed#16
Оценка90.1
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Artificial Analysis Intelligence Index
Рейтинг LMSpeed#15
Оценка53.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-GPQA Diamond
Рейтинг LMSpeed#10
Оценка92.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-HLE
Рейтинг LMSpeed#21
Оценка41.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-Omniscience Index
Рейтинг LMSpeed#37
Оценка0.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-Omniscience Accuracy
Рейтинг LMSpeed#14
Оценка49.1
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#2
Оценка94.1
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
AA Openness Index
Рейтинг LMSpeed#1
Оценка44.4
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка58.980% интервал46.8–71.12/4 Измеренные измеренияHMMT Feb 202695.2#2 / 18IMOAnswerBench89.8#2 / 7
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математика61.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
hmmt · hmmt_feb2026 · z 1.69 · q 1.00
Продвинутые доказательства56.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
imo · imo_answer_bench · z 0.34 · q 0.88
Прикладная математика и инструментыТолько априорное
HMMT Feb 2026Доказательство V3
Рейтинг LMSpeed#2
Оценка95.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
IMOAnswerBenchДоказательство V3
Рейтинг LMSpeed#2
Оценка89.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Apex
Рейтинг LMSpeed#2
Оценка38.3
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Apex Shortlist
Рейтинг LMSpeed#1
Оценка90.2
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2
Math score
Рейтинг LMSpeed#4
Оценка81.8
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

80% интервал30.8–69.20/4 Измеренные измеренияDesign Arena Website1258.0#33 / 75
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное
Design Arena Website
Рейтинг LMSpeed#33
Оценка1258.0
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка54.980% интервал38.9–70.91/4 Измеренные измеренияAA-IFBench76.5#10 / 84
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций54.9
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z 0.38 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#10
Оценка76.5
Источникbenchlm.ai
Обновлено23 авг. 2026 г.
Достоверность2

Эндпоинты OpenRouter

14 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Alibaba
alibaba
$1.16/M$3.48/M100.0%undefined токенов / undefined токенов
DeepSeek
deepseek
$0.660/M$1.98/M100.0%undefined токенов / undefined токенов
DigitalOcean
digitalocean
$1.32/M$3.96/M99.9%undefined токенов / —
Phala
phala
$1.45/M$4.36/M99.9%undefined токенов / undefined токенов
Fireworks
fireworks
$1.32/M$3.96/M99.9%undefined токенов / —
Novita
novita/fp8
$1.32/M$3.96/M99.9%undefined токенов / undefined токенов
GMICloud
gmicloud/fp8
$1.12/M$3.37/M99.9%undefined токенов / —
Sail Research
sail-research/fp4
$1.32/M$3.96/M99.8%undefined токенов / undefined токенов
BaseTen
baseten/fp4
$1.32/M$3.96/M99.5%undefined токенов / undefined токенов
StreamLake
streamlake
$1.32/M$3.96/M99.4%undefined токенов / undefined токенов
Parasail
parasail/fp8
$1.32/M$3.96/M99.4%undefined токенов / undefined токенов
SiliconFlow
siliconflow/fp8
$1.32/M$3.96/M98.6%undefined токенов / undefined токенов
Together
together
$1.32/M$3.96/M98.4%undefined токенов / —
Cloudflare
cloudflare
$1.32/M$3.96/M98.3%undefined токенов / undefined токенов

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API