Z.ai
·Released on 2026年2月11日

GLM-5 API 基准测试 价格和服务商数据

选择与 GLM-5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GLM-5 页面汇总基准测试、API 价格和服务商数据,覆盖 201 家服务商,价格从 $0.010/request 起。GLM-5 免费 API 额度来自 2 家服务商。页面同时展示实测速度和首字延迟。

Zhipu 的 GLM-5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。

质量
#50of 100
56.0
LMSpeed 评分
速度
51char/s
21.59 s
成本
#111of 181
$0.010/ 1M · 8:1 in:out
$0.0016 in · $0.0084 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体41.1代码51.5综合推理48.9知识43.3数学51.1多语言43.8多模态-指令遵循52.4
#1指令遵循52.4估算2/4 实测维度
80% 区间: 40.564.3
constraint following51.5
ifeval · ifeval
structured output仅先验
novel instruction generalization53.3
ifbench · aa_if_bench
long multiturn instruction仅先验
#2代码51.5正式评分全站排名 #243/4 实测维度
80% 区间: 43.459.6
code generation51.3
scicode · scicode
repository engineering47
react_native_bench · react_native_evals / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing56.1
swe_multilingual · benchlm_coding_swe_multilingual / swe_rebench · swe_rebench / swe_verified · swe_verified
tooling quality仅先验
#3数学51.1估算3/4 实测维度
80% 区间: 42.060.2
foundational math仅先验
competition math57.9
aime · aime2026 / hmmt · hmmt_feb2025 / hmmt · hmmt_feb2026 / hmmt · hmmt_nov2025
proof frontier48.2
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math47.2
mmanswer · mm_answer_bench
#4综合推理48.9正式评分全站排名 #443/4 实测维度
80% 区间: 40.857.0
abstract logic仅先验
scientific causal47.3
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints56.9
mmlu_pro · mmlu_pro
evidence verification42.5
ai_needle · ai_needle / lcr · lcr / longbench · long_bench_v2
#5多语言43.8估算2/4 实测维度
80% 区间: 31.656.0
cross language understanding39
nova · nova63
multilingual generation仅先验
reasoning transfer48.5
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#6知识43.3暂定评分1/4 实测维度
80% 区间: 27.059.5
broad knowledge仅先验
professional knowledge43.3
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#7智能体41.1正式评分全站排名 #534/4 实测维度
80% 区间: 35.546.7
planning51
deep_planning · gert_labs
tool use34.8
mcp_atlas · mcp_atlas / mcp_tasks · mcp_tasks / tau · tau2_bench / tau · tau3_bench / toolathlon · toolathlon
environment execution39.5
terminalbench · benchlm_agentic_terminal_bench2 / wide_research · wide_research
recovery reliability39.2
apex_agents · apex_agents_aa / claw_eval · claw_eval / cyber_gym · cyber_gym
暂无数据:多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
204.8Ktokens
245.8 pages of text
OUTPUT
128Ktokens
8K128K1M4M
204.8K

能力

Technical Details

输入
输出
发布日期
Feb 2026
Tokenizer
Other
架构
text->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score56.0#50 / 100
Overall score
站内排名#50
分数56.0
更新时间2026年9月1日
置信度4

价格

2 个指标

输入价格$1.00/M#111 / 181输出价格$3.20/M#104 / 181
输入价格
Input price
站内排名#111
分数$1.00/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#104
分数$3.20/M
更新时间2026年9月1日
置信度4

智能体

V3.0

14 个指标 · 正式评分

分数41.1#5380% 区间35.5–46.74/4 实测维度Agentic score44.3#54 / 69Terminal-Bench 2.056.2#39 / 53
维度与证据
规划拆解51
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.15 · q 1.00
工具调用34.8
4 个基准族 · 5 个指标
mcp_atlas · mcp_atlas · z -3.00 · q 1.00
mcp_tasks · mcp_tasks · z -1.09 · q 0.63
tau · tau2_bench · z 1.19 · q 1.00
tau · tau3_bench · z -1.74 · q 1.00
toolathlon · toolathlon · z -1.03 · q 1.00
环境与长程执行39.5
2 个基准族 · 2 个指标
terminalbench · benchlm_agentic_terminal_bench2 · z -0.47 · q 1.00
wide_research · wide_research · z -1.44 · q 1.00
恢复与完成可靠性39.2
3 个基准族 · 3 个指标
apex_agents · apex_agents_aa · z -0.84 · q 1.00
claw_eval · claw_eval · z -0.31 · q 1.00
cyber_gym · cyber_gym · z -2.55 · q 1.00
Agentic score
站内排名#54
分数44.3
更新时间2026年9月1日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#39
分数56.2
更新时间2026年9月1日
置信度4
Claw-EvalV3 计分证据
站内排名#19
分数57.7
更新时间2026年9月1日
置信度4
QwenClawBench
站内排名#6
分数54.1
更新时间2026年9月1日
置信度4
Τ³-bench resultsV3 计分证据
站内排名#9
分数65.6
更新时间2026年9月1日
置信度4
DeepPlanningV3 计分证据
站内排名#6
分数14.6
更新时间2026年9月1日
置信度4
ToolathlonV3 计分证据
站内排名#20
分数38.0
更新时间2026年9月1日
置信度4
MCP AtlasV3 计分证据
站内排名#30
分数31.1
更新时间2026年9月1日
置信度4
MCP-TasksV3 计分证据
站内排名#4
分数60.8
更新时间2026年9月1日
置信度4
WideResearchV3 计分证据
站内排名#8
分数69.8
更新时间2026年9月1日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#7
分数98.2
更新时间2026年9月1日
置信度4
CyberGymV3 计分证据
站内排名#15
分数43.2
更新时间2026年9月1日
置信度4
APEX-Agents-AAV3 计分证据
站内排名#18
分数14.5
更新时间2026年9月1日
置信度4
Gert LabsV3 计分证据
站内排名#21
分数51.0
更新时间2026年9月1日
置信度4

代码

V3.0

10 个指标 · 正式评分

分数51.5#2480% 区间43.4–59.63/4 实测维度SciCode46.2%#42 / 206Coding score58.9#25 / 81
维度与证据
代码生成51.3
1 个基准族 · 1 个指标
scicode · scicode · z 0.05 · q 1.00
仓库工程47
3 个基准族 · 3 个指标
react_native_bench · react_native_evals · z -0.36 · q 1.00
swe_pro · swe_pro · z -0.31 · q 1.00
vibecode · vibe_code_bench · z -0.07 · q 1.00
调试与测试56.1
3 个基准族 · 3 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z -0.32 · q 1.00
swe_rebench · swe_rebench · z 1.53 · q 1.00
swe_verified · swe_verified · z 0.20 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#42
分数46.2%
更新时间2026年9月1日
置信度4
Coding score
站内排名#25
分数58.9
更新时间2026年9月1日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#21
分数77.8
更新时间2026年9月1日
置信度4
SWE-bench Verified*
站内排名#3
分数72.8
更新时间2026年9月1日
置信度4
SWE-bench ProV3 计分证据
站内排名#34
分数55.1
更新时间2026年9月1日
置信度4
SWE MultilingualV3 计分证据
站内排名#14
分数73.3
更新时间2026年9月1日
置信度4
SWE-RebenchV3 计分证据
站内排名#2
分数62.8
更新时间2026年9月1日
置信度4
React Native EvalsV3 计分证据
站内排名#8
分数74.8
更新时间2026年9月1日
置信度4
AA-SciCodeV3 计分证据
站内排名#45
分数46.2
更新时间2026年9月1日
置信度4
Vibe Code BenchV3 计分证据
站内排名#19
分数23.4
更新时间2026年8月20日
置信度1

综合推理

V3.0

8 个指标 · 正式评分

分数48.9#4480% 区间40.8–57.03/4 实测维度MMLU-Pro85.7%#26 / 129GPQA82.0%#85 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理47.3
3 个基准族 · 3 个指标
critpt · critpt · z -0.14 · q 1.00
gpqa · gpqa · z -0.50 · q 1.00
hle · hle · z -0.43 · q 1.00
多步约束56.9
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.72 · q 1.00
证据整合与验证42.5
3 个基准族 · 3 个指标
ai_needle · ai_needle · z -2.25 · q 0.50
lcr · lcr · z 0.05 · q 1.00
longbench · long_bench_v2 · z -0.10 · q 1.00
MMLU-ProV3 计分证据
站内排名#26
分数85.7%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#85
分数82.0%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#54
分数29.3%
更新时间2026年9月1日
置信度4
Reasoning score
站内排名#26
分数43.0
更新时间2026年9月1日
置信度4
LongBench v2V3 计分证据
站内排名#6
分数60.8
更新时间2026年9月1日
置信度4
AI-NeedleV3 计分证据
站内排名#4
分数63.3
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#50
分数70.7
更新时间2026年9月1日
置信度4
CritPtV3 计分证据
站内排名#56
分数2.0
更新时间2026年9月1日
置信度4

知识

V3.0

10 个指标 · 暂定评分

分数43.380% 区间27.0–59.51/4 实测维度Knowledge score77.3#17 / 69GPQA-D86.0#29 / 31
维度与证据
广泛知识仅先验
专业知识43.3
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z -0.64 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#17
分数77.3
更新时间2026年9月1日
置信度4
GPQA-D
站内排名#29
分数86.0
更新时间2026年9月1日
置信度4
SuperGPQAV3 计分证据
站内排名#11
分数66.8
更新时间2026年9月1日
置信度4
MMLU-Pro (Arcee)
站内排名#3
分数85.8
更新时间2026年9月1日
置信度4
Artificial Analysis Intelligence Index
站内排名#42
分数40.5
更新时间2026年9月1日
置信度4
AA-GPQA Diamond
站内排名#67
分数82.0
更新时间2026年9月1日
置信度4
AA-HLE
站内排名#45
分数29.3
更新时间2026年9月1日
置信度4
AA-Omniscience Index
站内排名#39
分数0.3
更新时间2026年9月1日
置信度4
AA-Omniscience Accuracy
站内排名#63
分数26.3
更新时间2026年9月1日
置信度4
AA-Omniscience Hallucination Rate
站内排名#88
分数35.3
更新时间2026年9月1日
置信度4

数学

V3.0

9 个指标 · 估算

分数51.180% 区间42.0–60.23/4 实测维度Math score56.9#31 / 62AIME2695.8#4 / 14
维度与证据
基础数学仅先验
竞赛数学57.9
2 个基准族 · 4 个指标
aime · aime2026 · z 0.48 · q 1.00
hmmt · hmmt_feb2025 · z 1.83 · q 0.88
hmmt · hmmt_feb2026 · z -0.15 · q 1.00
hmmt · hmmt_nov2025 · z 2.19 · q 1.00
高阶证明48.2
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z -0.64 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z -0.27 · q 1.00
应用与工具辅助数学47.2
1 个基准族 · 1 个指标
mmanswer · mm_answer_bench · z -0.32 · q 1.00
Math score
站内排名#31
分数56.9
更新时间2026年9月1日
置信度4
AIME26V3 计分证据
站内排名#4
分数95.8
更新时间2026年9月1日
置信度4
AIME25 (Arcee)
站内排名#4
分数93.3
更新时间2026年9月1日
置信度4
HMMT Feb 2025V3 计分证据
站内排名#1
分数97.5
更新时间2026年9月1日
置信度4
HMMT Nov 2025V3 计分证据
站内排名#1
分数96.9
更新时间2026年9月1日
置信度4
HMMT Feb 2026V3 计分证据
站内排名#14
分数86.4
更新时间2026年9月1日
置信度4
MMAnswerBenchV3 计分证据
站内排名#6
分数82.5
更新时间2026年9月1日
置信度4
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#31
分数16.4
更新时间2026年9月1日
置信度4
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#30
分数2.1
更新时间2026年9月1日
置信度4

多语言

V3.0

3 个指标 · 估算

分数43.880% 区间31.6–56.02/4 实测维度Multilingual score48.7#6 / 11MMLU-ProX83.1#6 / 11
维度与证据
跨语言理解39
1 个基准族 · 1 个指标
nova · nova63 · z -1.47 · q 0.88
多语言生成仅先验
推理迁移48.5
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z 0.00 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#6
分数48.7
更新时间2026年9月1日
置信度4
MMLU-ProXV3 计分证据
站内排名#6
分数83.1
更新时间2026年9月1日
置信度4
NOVA-63V3 计分证据
站内排名#7
分数55.1
更新时间2026年9月1日
置信度4

多模态

V3.0

1 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度Design Arena Website1267.0#31 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
Design Arena Website
站内排名#31
分数1267.0
更新时间2026年9月1日
置信度4

指令遵循

V3.0

3 个指标 · 估算

分数52.480% 区间40.5–64.32/4 实测维度Instruction Following score87.4#12 / 25IFEval92.6#8 / 16
维度与证据
约束遵循51.5
1 个基准族 · 1 个指标
ifeval · ifeval · z 0.00 · q 1.00
结构化输出仅先验
新指令泛化53.3
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.16 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#12
分数87.4
更新时间2026年9月1日
置信度4
IFEvalV3 计分证据
站内排名#8
分数92.6
更新时间2026年9月1日
置信度4
AA-IFBenchV3 计分证据
站内排名#31
分数72.3
更新时间2026年9月1日
置信度4

OpenRouter 端点

11 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Novita
novita/fp8
$1/M$3.20/M100.0%undefined tokens / undefined tokens
Z.AI
z-ai/fp8
$1/M$3.20/M100.0%undefined tokens / undefined tokens
StreamLake
streamlake/fp8
$0.600/M$1.92/M99.9%undefined tokens / undefined tokens
AtlasCloud
atlas-cloud/fp8
$0.950/M$3.15/M99.9%undefined tokens / undefined tokens
SiliconFlow
siliconflow/fp8
$0.950/M$2.55/M99.9%undefined tokens / undefined tokens
Baidu
baidu/fp8
$0.700/M$2.24/M99.9%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp4
$0.600/M$2.08/M99.9%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock
$1/M$3.20/M99.9%undefined tokens / undefined tokens
GMICloud
gmicloud/fp8
$0.600/M$1.92/M99.1%undefined tokens / undefined tokens
Venice
venice/fp8
$1/M$3.20/M97.7%undefined tokens / undefined tokens
DigitalOcean
digitalocean
$1/M$3.20/M93.1%undefined tokens / undefined tokens

价格对比

对比 GLM-5 在 199 家服务商的 API 价格。价格从 $0.010/request 到 $150.00/M,其中 素墨API 提供最低价 $0.010/request。 2 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
99%
L2
95%
z-ai/glm-5
default
-20%$0.800/M
Cache read$0.160/M
-20%$2.56/M
139.0 t/s
13.57 s
L1
99%
L2
0%
z-ai/glm-5
default
-52%$0.480/M
Cache read$0.200/M
-52%$1.54/M
42.9 t/s
24.10 s
L1
100%
glm-5
限时特价
$45.00/M
$45.00/M
36.1 t/s
21.94 s
L1
100%
glm-5
default
-73%$0.274/M
-61%$1.23/M
L1
100%
glm-5
bailian
-71%$0.286/M
Cache read$0.057/M
-60%$1.29/M
L1
100%
GLM-5
default
$0.040/request
-
L1
100%
glm-5
sale
$2.00/M
$9.00/M
L1
100%
glm-5
default
-18%$0.822/M
$3.29/M
L1
100%
glm-5
default
-45%$0.548/M
-23%$2.47/M
L1
100%
glm-5
default
-23%$0.767/M
-62%$1.23/M
L1
100%
glm-5
default
-76%$0.240/M
Cache read$0.048/M
-76%$0.767/M
L1
100%
glm-5
国产模型
-11%$0.886/M
Cache read$0.886/MCache write$0.177/MCache write 1h$0.283/M
-11%$2.83/M
L1
100%
glm-5
default
$4.00/M
Cache read$0.800/M
$18.00/M
L1
100%
GLM-5
Zai-officially
$9.25/M
$9.25/M
L1
100%
glm-5
test
-86%$0.137/M
Cache read$0.027/M
-86%$0.438/M
L1
100%
glm-5
glm
-78%$0.219/M
Cache read$0.044/M
-73%$0.877/M
L1
100%
glm-5
default
-73%$0.274/M
-61%$1.23/M
L1
99%
glm-5
other
-58%$0.417/M
Cache read$0.083/M
-58%$1.33/M
L1
100%
glm-5
default
-45%$0.548/M
Cache read$0.137/M
-23%$2.47/M
L1
100%
glm-5
default
-45%$0.551/M
-27%$2.34/M
当前显示 20 个模型 ID,共 76 个。

替代方案与相似模型

常见问题

GLM-5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GLM-5 的基准测试、API 价格、输出速度、首字延迟和 201 家服务商数据。
GLM-5 API 价格是多少?
GLM-5201 家服务商有价格记录,价格从 $0.010/request $150.00/M。最低价由 素墨API 提供。
GLM-5 API 价格表包含什么?
GLM-5 API 价格表会对比 201 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GLM-5 API 价格最低?
素墨API 当前提供 GLM-5 的最低收录价格:$0.010/request,共对比 201 家服务商。
可以同时对比 GLM-5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GLM-5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GLM-5 的 API 免费吗?
是的,GLM-5 免费 API 可通过 LMSpeed 上的 2 家服务商使用,包括Moyanjdc API, Zero API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GLM-5 免费 API?
LMSpeed 当前收录了 2 家 GLM-5 免费 API 服务商,包括Moyanjdc API, Zero API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

GLM-5GLM-5-2ccGLM-5-fastPro/zai-org/GLM-5Z-AI/GLM-5

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档