GLM 5.3 API 基准测试 价格和服务商数据
选择与 GLM 5.3 对比的模型
选择一个模型后会直接打开对应的对比页面。
GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves....
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 2 / 8
- 方法论
- V3.0
#1代码63.3暂定评分1/4 实测维度
#2综合推理61.2暂定评分1/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
详细分数
更新时间: 2026年8月20日速度与延迟
2 个指标
输出速度79.6 tok/s#42 / 73首字延迟1.51 s#45 / 73
速度与延迟
2 个指标
价格
2 个指标
输入价格$1.40/M#132 / 180输出价格$4.40/M#115 / 180
价格
2 个指标
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
代码
V3.01 个指标 · 暂定评分
分数63.380% 区间47.3–79.21/4 实测维度SciCode56.5%#7 / 204
代码
V3.01 个指标 · 暂定评分
综合推理
V3.02 个指标 · 暂定评分
分数61.280% 区间47.3–75.21/4 实测维度GPQA91.7%#18 / 211HLE42.3%#21 / 208
综合推理
V3.02 个指标 · 暂定评分
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
OpenRouter 端点
1 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
Z.AI z-ai/fp8 | $1.40/M | $4.40/M | 100.0% | — | — | undefined tokens / undefined tokens |
替代方案与相似模型
DeepSeek V4 Flash
deepseek-v4-flash
DeepSeek V4 Flash是DeepSeek V4 系列的语言模型,专为通用对话与文本生成任务优化。
DeepSeek V4 Pro
deepseek-v4-pro
DeepSeek V4 Pro是DeepSeek V4 系列的语言模型,专为通用对话与文本生成任务优化。
GLM-5.1
glm-5-1
Zhipu 的 GLM-5.1是语言模型,专为通用对话与文本生成任务优化。
Kimi K2.5
kimi-k2-5
Moonshot 的 Kimi K2.5是语言模型,专为通用对话与文本生成任务优化。
GLM-5
glm-5
Zhipu 的 GLM-5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
MiniMax M2.5
minimax-m2-5
MiniMax M2.5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
