DeepSeek V3 API 基准测试 价格和服务商数据

选择与 DeepSeek V3 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

DeepSeek V3 页面汇总基准测试、API 价格和服务商数据,覆盖 511 家服务商,价格从 $0.0037/M 起。DeepSeek V3 免费 API 额度来自 7 家服务商。页面同时展示实测速度和首字延迟。

TEST_ZH_DESC_12345

质量
#87of 100
44.0
LMSpeed 评分
速度
49char/s
3.39 s
成本
#71of 181
$0.0037/ 1M · 8:1 in:out
$0.0006 in · $0.0031 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体34.7代码37.4综合推理44.4知识41.1数学49.5多语言-多模态-指令遵循39.7
#1数学49.5估算3/4 实测维度
80% 区间: 40.258.7
foundational math54.7
math_500 · math_500
competition math53.6
aime · aime
proof frontier40.1
frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#2综合推理44.4正式评分全站排名 #563/4 实测维度
80% 区间: 35.753.0
abstract logic仅先验
scientific causal43.7
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints53.2
mmlu_pro · mmlu_pro
evidence verification36.2
lcr · lcr
#3知识41.1暂定评分1/4 实测维度
80% 区间: 25.157.1
broad knowledge41.1
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#4指令遵循39.7估算2/4 实测维度
80% 区间: 27.851.6
constraint following37.7
ifeval · ifeval
structured output仅先验
novel instruction generalization41.8
ifbench · aa_if_bench
long multiturn instruction仅先验
#5代码37.4估算2/4 实测维度
80% 区间: 26.248.5
code generation46.9
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing27.9
swe_verified · swe_verified
tooling quality仅先验
#6智能体34.7估算2/4 实测维度
80% 区间: 22.846.5
planning仅先验
tool use38.5
tau · tau2_bench
environment execution30.8
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliability仅先验
暂无数据:多语言多模态

技术规格

Technical Details

官方文档

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score44.0#87 / 100
Overall score
站内排名#87
分数44.0
更新时间2026年8月20日
置信度1

价格

2 个指标

输入价格$0.360/M#71 / 181输出价格$0.890/M#43 / 181
输入价格
Input price
站内排名#71
分数$0.360/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#43
分数$0.890/M
更新时间2026年9月1日
置信度4

智能体

V3.0

3 个指标 · 估算

分数34.780% 区间22.8–46.52/4 实测维度AA Agentic Index1.6#61 / 65Τ²-bench results22.8#76 / 82
维度与证据
规划拆解仅先验
工具调用38.5
1 个基准族 · 1 个指标
tau · tau2_bench · z -1.65 · q 1.00
环境与长程执行30.8
1 个基准族 · 1 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z -2.74 · q 1.00
恢复与完成可靠性仅先验
AA Agentic Index
站内排名#61
分数1.6
更新时间2026年8月20日
置信度1
Τ²-bench resultsV3 计分证据
站内排名#76
分数22.8
更新时间2026年8月20日
置信度1
GDPval-AAV3 计分证据
站内排名#63
分数231.0
更新时间2026年8月20日
置信度1

代码

V3.0

5 个指标 · 估算

分数37.480% 区间26.2–48.52/4 实测维度LiveCodeBench35.9%#78 / 115SciCode35.4%#127 / 206
维度与证据
代码生成46.9
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.21 · q 1.00
scicode · scicode · z -0.19 · q 1.00
仓库工程仅先验
调试与测试27.9
1 个基准族 · 1 个指标
swe_verified · swe_verified · z -3.00 · q 1.00
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#78
分数35.9%
更新时间2026年9月1日
置信度4
SciCodeV3 计分证据
站内排名#127
分数35.4%
更新时间2026年9月1日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#48
分数42.0
更新时间2026年8月20日
置信度1
AA Coding Index
站内排名#61
分数23.0
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#88
分数35.4
更新时间2026年8月20日
置信度1

综合推理

V3.0

4 个指标 · 正式评分

分数44.4#5680% 区间35.7–53.03/4 实测维度MMLU-Pro75.2%#85 / 129GPQA55.7%#178 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理43.7
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.54 · q 1.00
hle · hle · z -0.77 · q 1.00
多步约束53.2
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.22 · q 1.00
证据整合与验证36.2
1 个基准族 · 1 个指标
lcr · lcr · z -2.19 · q 1.00
MMLU-ProV3 计分证据
站内排名#85
分数75.2%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#178
分数55.7%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#204
分数2.9%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#92
分数31.7
更新时间2026年8月20日
置信度1

知识

V3.0

5 个指标 · 暂定评分

分数41.180% 区间25.1–57.11/4 实测维度Artificial Analysis Intelligence Index14.2#96 / 111AA-GPQA Diamond55.7#101 / 108
维度与证据
广泛知识41.1
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -1.27 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#96
分数14.2
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#101
分数55.7
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#106
分数2.9
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#67
分数25.5
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#19
分数90.0
更新时间2026年8月20日
置信度1

数学

V3.0

4 个指标 · 估算

分数49.580% 区间40.2–58.73/4 实测维度AIME25.3%#44 / 68MATH-50088.7%#37 / 73
维度与证据
基础数学54.7
1 个基准族 · 1 个指标
math_500 · math_500 · z 0.66 · q 1.00
竞赛数学53.6
1 个基准族 · 1 个指标
aime · aime · z 0.46 · q 1.00
高阶证明40.1
1 个基准族 · 1 个指标
frontiermath · frontier_math_v2_tiers13 · z -1.67 · q 1.00
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#44
分数25.3%
更新时间2026年9月1日
置信度4
MATH-500V3 计分证据
站内排名#37
分数88.7%
更新时间2026年9月1日
置信度4
Math score
站内排名#56
分数26.1
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#44
分数1.7
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

1 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度Design Arena Website1131.0#63 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
Design Arena Website
站内排名#63
分数1131.0
更新时间2026年8月20日
置信度1

指令遵循

V3.0

2 个指标 · 估算

分数39.780% 区间27.8–51.62/4 实测维度IFEval86.1#15 / 16AA-IFBench34.8#79 / 84
维度与证据
约束遵循37.7
1 个基准族 · 1 个指标
ifeval · ifeval · z -1.84 · q 1.00
结构化输出仅先验
新指令泛化41.8
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.37 · q 1.00
多轮与长指令仅先验
IFEvalV3 计分证据
站内排名#15
分数86.1
更新时间2026年8月20日
置信度1
AA-IFBenchV3 计分证据
站内排名#79
分数34.8
更新时间2026年8月20日
置信度1

价格对比

对比 DeepSeek V3 在 504 家服务商的 API 价格。价格从 $0.0037/M 到 $95.45/M,其中 6345ywz API 提供最低价 $0.0037/M。 7 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
deepseek-v3
default
-62%$0.137/M
-38%$0.548/M
L1
100%
deepseek-v3-0324
default
-62%$0.137/M
-38%$0.548/M
L1
100%
deepseek-v3-250324
default
-62%$0.137/M
-38%$0.548/M
L1
100%
DeepSeek-V3
default
$0.025/request
-
L1
100%
deepseek-v3-0324
default
-24%$0.274/M
$1.10/M
L1
100%
deepseek-v3
default
-24%$0.274/M
$1.10/M
L1
100%
deepseek-v3-fast
default
$10.27/M
$20.55/M
L1
100%
siliconflow/deepseek-v3-0324
default
$10.27/M
$10.27/M
L1
100%
deepseek-v3-0324
default
-45%$0.197/M
-11%$0.789/M
L1
100%
deepseek-v3
default
-40%$0.215/M
-3%$0.859/M
L1
100%
deepseek-v3-0324
default
-24%$0.274/M
$1.10/M
L1
100%
deepseek-v3
default
-24%$0.274/M
$1.10/M
L1
100%
deepseek-v3-250324
default
-24%$0.274/M
$1.10/M
L1
100%
deepseek-ai/DeepSeek-V3
default
$0.600/M
$2.40/M
兔子API
免费
L1
100%
deepseek-v3-all
default
免费
免费
L1
100%
deepseek-v3
default
免费
免费
L1
100%
deepseek-v3-0324
default
免费
免费
L1
100%
deepseek-v3-250324
default
免费
免费
L1
100%
deepseek-v3-0324
default
$0.010/request
-
L1
100%
deepseek v3
额度
-17%$0.300/M
$1.20/M
当前显示 20 个模型 ID,共 127 个。

替代方案与相似模型

常见问题

DeepSeek V3 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 DeepSeek V3 的基准测试、API 价格、输出速度、首字延迟和 511 家服务商数据。
DeepSeek V3 API 价格是多少?
DeepSeek V3511 家服务商有价格记录,价格从 $0.0037/M $95.45/M。最低价由 6345ywz API 提供。
DeepSeek V3 API 价格表包含什么?
DeepSeek V3 API 价格表会对比 511 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 DeepSeek V3 API 价格最低?
6345ywz API 当前提供 DeepSeek V3 的最低收录价格:$0.0037/M,共对比 511 家服务商。
可以同时对比 DeepSeek V3 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 DeepSeek V3 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
DeepSeek V3 的 API 免费吗?
是的,DeepSeek V3 免费 API 可通过 LMSpeed 上的 7 家服务商使用,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 DeepSeek V3 免费 API?
LMSpeed 当前收录了 7 家 DeepSeek V3 免费 API 服务商,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

DeepSeek-V3DeepSeek-V3-0324DeepSeek-V3-0324-128kDeepSeek-V3-0324-fastDeepSeek-V3-128K

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档