Z.ai
·Released on 2026年4月7日

GLM-5.1 API 基准测试 价格和服务商数据

选择与 GLM-5.1 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GLM-5.1 页面汇总基准测试、API 价格和服务商数据,覆盖 186 家服务商,价格从 $0.0008/M 起。GLM-5.1 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

Zhipu 的 GLM-5.1是语言模型,专为通用对话与文本生成任务优化。

质量
#48of 112
60.0
LMSpeed 评分
速度
50char/s
14.60 s
成本
#120of 186
$0.0008/ 1M · 8:1 in:out
$0.0001 in · $0.0007 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体52.5代码54.3综合推理54知识52.9数学51.5多语言-多模态-指令遵循54.9
#1指令遵循54.9暂定评分1/4 实测维度
80% 区间: 38.970.9
constraint following仅先验
structured output仅先验
novel instruction generalization54.9
ifbench · aa_if_bench
long multiturn instruction仅先验
#2代码54.3正式评分全站排名 #183/4 实测维度
80% 区间: 45.663.1
code generation52.4
scicode · scicode
repository engineering50.2
nl2repo · nl2_repo / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing60.4
swe_rebench · swe_rebench
tooling quality仅先验
#3综合推理54估算2/4 实测维度
80% 区间: 43.364.8
abstract logic仅先验
scientific causal55.4
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification52.7
lcr · lcr
#4知识52.9暂定评分1/4 实测维度
80% 区间: 39.066.9
broad knowledge52.9
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#5智能体52.5正式评分全站排名 #314/4 实测维度
80% 区间: 46.858.2
planning55.7
deep_planning · gert_labs
tool use54.3
mcp_atlas · mcp_atlas / tau · tau2_bench / tau · tau3_bench
environment execution48
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability52.1
claw_eval · claw_eval / cyber_gym · cyber_gym / researchclaw · research_claw_bench
#6数学51.5估算3/4 实测维度
80% 区间: 42.460.5
foundational math仅先验
competition math48.7
aime · aime2026 / hmmt · hmmt_feb2026 / hmmt · hmmt_nov2025
proof frontier53.6
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math52
mmanswer · mm_answer_bench
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
204.8Ktokens
245.8 pages of text
OUTPUT
128Ktokens
8K128K1M4M
204.8K

能力

Technical Details

输入
输出
发布日期
Apr 2026
Tokenizer
Other
架构
text->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月14日

综合

1 个指标

Overall score60.0#48 / 112
Overall score
站内排名#48
分数60.0
更新时间2026年9月14日
置信度3

价格

2 个指标

输入价格$1.20/M#120 / 186输出价格$4.40/M#119 / 186
输入价格
Input price
站内排名#120
分数$1.20/M
更新时间2026年9月14日
置信度4
输出价格
Output price
站内排名#119
分数$4.40/M
更新时间2026年9月14日
置信度4

智能体

V3.0

14 个指标 · 正式评分

分数52.5#3180% 区间46.8–58.24/4 实测维度Agentic score46.9#60 / 77Terminal-Bench 2.063.5#28 / 53
维度与证据
规划拆解55.7
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.77 · q 1.00
工具调用54.3
2 个基准族 · 3 个指标
mcp_atlas · mcp_atlas · z -0.15 · q 1.00
tau · tau2_bench · z 1.08 · q 1.00
tau · tau3_bench · z 0.16 · q 1.00
环境与长程执行48
3 个基准族 · 3 个指标
browsecomp · browse_comp · z -1.03 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.04 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.02 · q 1.00
恢复与完成可靠性52.1
3 个基准族 · 3 个指标
claw_eval · claw_eval · z 0.45 · q 1.00
cyber_gym · cyber_gym · z -0.82 · q 1.00
researchclaw · research_claw_bench · z 0.06 · q 1.00
Agentic score
站内排名#60
分数46.9
更新时间2026年9月14日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#28
分数63.5
更新时间2026年9月14日
置信度3
BrowseCompV3 计分证据
站内排名#24
分数68.0
更新时间2026年9月14日
置信度3
Τ³-bench resultsV3 计分证据
站内排名#4
分数70.6
更新时间2026年9月14日
置信度3
MCP AtlasV3 计分证据
站内排名#18
分数71.8
更新时间2026年9月14日
置信度3
CyberGymV3 计分证据
站内排名#10
分数68.7
更新时间2026年9月14日
置信度3
Claw-EvalV3 计分证据
站内排名#10
分数62.3
更新时间2026年9月14日
置信度3
AA Agentic Index
站内排名#36
分数25.2
更新时间2026年9月14日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#9
分数97.7
更新时间2026年9月14日
置信度3
GDPval-AA
站内排名#34
分数34.0
更新时间2026年9月14日
置信度3
Gert LabsV3 计分证据
站内排名#12
分数60.1
更新时间2026年9月14日
置信度3
GDPval-AAV3 计分证据
站内排名#35
分数1181.0
更新时间2026年9月14日
置信度3
ResearchClawBenchV3 计分证据
站内排名#7
分数18.2
更新时间2026年9月14日
置信度3
Terminal-Bench 2.1 (Vals)
站内排名#27
分数56.9
更新时间2026年9月14日
置信度3

代码

V3.0

11 个指标 · 正式评分

分数54.3#1880% 区间45.6–63.13/4 实测维度SciCode44.8%#46 / 89Coding score52.1#49 / 87
维度与证据
代码生成52.4
1 个基准族 · 1 个指标
scicode · scicode · z 0.15 · q 1.00
仓库工程50.2
3 个基准族 · 3 个指标
nl2repo · nl2_repo · z -0.04 · q 1.00
swe_pro · swe_pro · z 0.23 · q 1.00
vibecode · vibe_code_bench · z 0.25 · q 1.00
调试与测试60.4
1 个基准族 · 1 个指标
swe_rebench · swe_rebench · z 1.49 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#46
分数44.8%
更新时间2026年9月14日
置信度4
Coding score
站内排名#49
分数52.1
更新时间2026年9月14日
置信度3
SWE-bench ProV3 计分证据
站内排名#20
分数58.4
更新时间2026年9月14日
置信度3
NL2RepoV3 计分证据
站内排名#9
分数42.7
更新时间2026年9月14日
置信度3
SWE-RebenchV3 计分证据
站内排名#3
分数62.7
更新时间2026年9月14日
置信度3
Vibe Code BenchV3 计分证据
站内排名#14
分数31.5
更新时间2026年9月14日
置信度3
AA Coding Index
站内排名#39
分数55.8
更新时间2026年9月14日
置信度3
AA-SciCodeV3 计分证据
站内排名#57
分数44.8
更新时间2026年9月14日
置信度3
OpenHarmony Bench
站内排名#6
分数52.3
更新时间2026年9月14日
置信度3
LiveCodeBench (Vals)
站内排名#32
分数81.4
更新时间2026年9月14日
置信度3
SWE-bench (Vals)
站内排名#27
分数76.4
更新时间2026年9月14日
置信度3

综合推理

V3.0

5 个指标 · 估算

分数5480% 区间43.3–64.82/4 实测维度GPQA86.8%#55 / 218HLE30.1%#56 / 216
维度与证据
抽象逻辑仅先验
科学与因果推理55.4
3 个基准族 · 3 个指标
critpt · critpt · z 0.16 · q 1.00
gpqa · gpqa · z 0.37 · q 1.00
hle · hle · z 0.51 · q 1.00
多步约束仅先验
证据整合与验证52.7
1 个基准族 · 1 个指标
lcr · lcr · z 0.01 · q 1.00
GPQAV3 计分证据
站内排名#55
分数86.8%
更新时间2026年9月14日
置信度4
HLEV3 计分证据
站内排名#56
分数30.1%
更新时间2026年9月14日
置信度4
AA-LCRV3 计分证据
站内排名#54
分数73.7
更新时间2026年9月14日
置信度3
CritPtV3 计分证据
站内排名#51
分数4.6
更新时间2026年9月14日
置信度3
Reasoning score
站内排名#33
分数71.7
更新时间2026年9月14日
置信度3

知识

V3.0

10 个指标 · 暂定评分

分数52.980% 区间39.0–66.91/4 实测维度Knowledge score71.2#37 / 83GPQA-D86.2#29 / 32
维度与证据
广泛知识52.9
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.15 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.09 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#37
分数71.2
更新时间2026年9月14日
置信度3
GPQA-D
站内排名#29
分数86.2
更新时间2026年9月14日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#56
分数26.4
更新时间2026年9月14日
置信度3
AA-GPQA Diamond
站内排名#51
分数86.8
更新时间2026年9月14日
置信度3
AA-HLE
站内排名#49
分数30.1
更新时间2026年9月14日
置信度3
AA-Omniscience IndexV3 计分证据
站内排名#40
分数0.9
更新时间2026年9月14日
置信度3
AA-Omniscience Accuracy
站内排名#79
分数23.7
更新时间2026年9月14日
置信度3
AA-Omniscience Hallucination Rate
站内排名#99
分数29.9
更新时间2026年9月14日
置信度3
GPQA Diamond (Vals)
站内排名#33
分数84.5
更新时间2026年9月14日
置信度3
MMLU-Pro (Vals)
站内排名#25
分数86.9
更新时间2026年9月14日
置信度3

数学

V3.0

7 个指标 · 估算

分数51.580% 区间42.4–60.53/4 实测维度Math score64.1#25 / 63AIME2695.3#7 / 14
维度与证据
基础数学仅先验
竞赛数学48.7
2 个基准族 · 3 个指标
aime · aime2026 · z 0.00 · q 1.00
hmmt · hmmt_feb2026 · z -0.62 · q 1.00
hmmt · hmmt_nov2025 · z 0.32 · q 1.00
高阶证明53.6
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.40 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.27 · q 1.00
应用与工具辅助数学52
1 个基准族 · 1 个指标
mmanswer · mm_answer_bench · z 0.32 · q 1.00
Math score
站内排名#25
分数64.1
更新时间2026年9月14日
置信度3
AIME26V3 计分证据
站内排名#7
分数95.3
更新时间2026年9月14日
置信度3
HMMT Nov 2025V3 计分证据
站内排名#4
分数94.0
更新时间2026年9月14日
置信度3
HMMT Feb 2026V3 计分证据
站内排名#18
分数82.6
更新时间2026年9月14日
置信度3
MMAnswerBenchV3 计分证据
站内排名#4
分数83.8
更新时间2026年9月14日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#17
分数33.4
更新时间2026年9月14日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#17
分数12.5
更新时间2026年9月14日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

1 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度Design Arena Website1290.0#18 / 78
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
Design Arena Website
站内排名#18
分数1290.0
更新时间2026年9月14日
置信度3

指令遵循

V3.0

2 个指标 · 暂定评分

分数54.980% 区间38.9–70.91/4 实测维度AA-IFBench76.3#10 / 84Instruction Following score93.7#2 / 52
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化54.9
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.37 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#10
分数76.3
更新时间2026年9月14日
置信度3
Instruction Following score
站内排名#2
分数93.7
更新时间2026年9月14日
置信度3

OpenRouter 端点

15 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Alibaba
alibaba/fp8
$1.33/M$4.18/M100%undefined tokens / undefined tokens
Friendli
friendli
$1.40/M$4.40/M100.0%undefined tokens / undefined tokens
Baidu
baidu/fp8
$1.40/M$4.40/M100.0%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp4
$1.05/M$3.50/M99.9%undefined tokens / undefined tokens
SiliconFlow
siliconflow/fp8
$1.19/M$3.74/M99.9%undefined tokens / undefined tokens
Novita
novita/fp8
$1.38/M$4.40/M99.8%undefined tokens / undefined tokens
AtlasCloud
atlas-cloud/fp8
$1.26/M$3.96/M99.8%undefined tokens / undefined tokens
Z.AI
z-ai/fp8
$1.40/M$4.40/M99.7%undefined tokens / undefined tokens
StreamLake
streamlake/fp8
$0.966/M$3.04/M99.7%undefined tokens / undefined tokens
Crusoe
crusoe/fp8
$1.20/M$4.40/M99.7%undefined tokens / undefined tokens
GMICloud
gmicloud/fp8
$1.40/M$4.40/M99.5%undefined tokens / undefined tokens
Nebius
nebius/fp8
$1.40/M$4.40/M97.7%undefined tokens / undefined tokens
Venice
venice/fp8
$1.40/M$4.40/M93.4%undefined tokens / undefined tokens
Chutes
chutes/fp8
$0.980/M$3.08/M89.3%undefined tokens / undefined tokens
Phala
phala
$1.21/M$4.20/M87.9%undefined tokens / undefined tokens

价格对比

对比 GLM-5.1 在 181 家服务商的 API 价格。价格从 $0.0008/M 到 $97.50/M,其中 S3AI API 提供最低价 $0.0008/M。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
99%
glm-5.1
临时渠道
-93%$0.082/M
Cache read$0.018/M
-93%$0.329/M
148.1 t/s
5.30 s
L1
99%
z-ai/glm-5.1
临时渠道
-99%$0.017/M
Cache read$0.0037/M
-99%$0.054/M
L1
100%
L2
0%
z-ai/glm-5.1
default
-7%$1.12/M
Cache read$0.208/M
-20%$3.52/M
97.8 t/s
17.08 s
L1
0%
glm-5.1
default
$75.00/M
$75.00/M
57.4 t/s
5.14 s
L1
100%
glm-5.1
default
-8%$1.10/M
Cache read$0.268/M
-7%$4.08/M
41.9 t/s
15.34 s
L1
100%
glm-5.1
default
-66%$0.411/M
Cache read$0.090/M
-63%$1.64/M
L1
99%
L2
0%
z-ai/glm-5.1
default
$1.40/M
Cache read$0.260/M
$4.40/M
L1
100%
glm-5.1
default
-9%$1.10/M
-13%$3.84/M
L1
100%
Pro/zai-org/GLM-5.1
default
$10.27/M
$10.27/M
L1
100%
glm-5.1
default
-66%$0.411/M
Cache read$0.090/M
-63%$1.64/M
L1
100%
glm-5.1
default
-36%$0.767/M
-69%$1.38/M
L1
100%
glm-5.1
Self-Deployed-2
-83%$0.208/M
Cache read$0.046/M
-85%$0.652/M
L1
100%
L2
100%
glm-5.1
OpenModels
-33%$0.800/M
Cache read$0.200/MCache write$0.800/MCache write 1h$1.28/M
-36%$2.80/M
L1
100%
glm-5.1
国产模型
$1.25/M
Cache read$1.25/MCache write$0.232/MCache write 1h$0.371/M
-11%$3.92/M
L1
100%
glm-5.1
default
$6.00/M
Cache read$1.20/MCache write$7.50/MCache write 1h$12.00/M
$24.00/M
L1
100%
[mt]q|次/glm-5.1
default
$9.00/request
-
L1
99%
L2
100%
glm-5.1
default
免费
免费
L1
100%
glm-5.1
default
-92%$0.096/M
Cache read$0.018/M
-93%$0.301/M
L1
100%
glm-5.1
default
-89%$0.137/M
-81%$0.822/M
L1
100%
L2
0%
glm-5.1
default
-28%$0.870/M
Cache read$0.170/M
-21%$3.48/M
当前显示 20 个模型 ID,共 88 个。

替代方案与相似模型

常见问题

GLM-5.1 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GLM-5.1 的基准测试、API 价格、输出速度、首字延迟和 186 家服务商数据。
GLM-5.1 API 价格是多少?
GLM-5.1 在 186 家服务商有价格记录,价格从 $0.0008/M$97.50/M。最低价由 S3AI API 提供。
GLM-5.1 API 价格表包含什么?
GLM-5.1 API 价格表会对比 186 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GLM-5.1 API 价格最低?
S3AI API 当前提供 GLM-5.1 的最低收录价格:$0.0008/M,共对比 186 家服务商。
可以同时对比 GLM-5.1 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GLM-5.1 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GLM-5.1 的 API 免费吗?
是的,GLM-5.1 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括DeadlySignal API, 兔子API, Moyanjdc API, Zero API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GLM-5.1 免费 API?
LMSpeed 当前收录了 5 家 GLM-5.1 免费 API 服务商,包括DeadlySignal API, 兔子API, Moyanjdc API, Zero API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

GLM-5-1GLM-5.1GLM-5.1(nsfw)GLM-5.1-免费Pro/zai-org/GLM-5.1

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档