Z.ai
·Released on 2026年8月26日

GLM 5.3 Flash API 基准测试 价格和服务商数据

选择与 GLM 5.3 Flash 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

页面同时展示实测速度和首字延迟。

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-contex...

速度
#68of 76
283char/s
16.46 s

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
2 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体-代码56.5综合推理60.7知识-数学-多语言-多模态-指令遵循-
#1综合推理60.7暂定评分1/4 实测维度
80% 区间: 46.874.6
abstract logic仅先验
scientific causal60.7
gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification仅先验
#2代码56.5暂定评分1/4 实测维度
80% 区间: 40.572.4
code generation56.5
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识数学多语言多模态指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.3Mtokens
1.6K pages of text
OUTPUT
131.1Ktokens
8K128K1M4M
1.3M

能力

Technical Details

输入
输出
发布日期
Aug 2026
Tokenizer
Other
架构
text+image+video->text
内容审核
到期日期
2098-12-31
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

详细分数

更新时间: 2026年8月27日

速度与延迟

2 个指标

输出速度41.8 tok/s#68 / 76首字延迟1.16 s#39 / 76
输出速度
Output speed
站内排名#68
分数41.8 tok/s
更新时间2026年8月27日
置信度4
首字延迟
Time to first token
站内排名#39
分数1.16 s
更新时间2026年8月27日
置信度4

价格

2 个指标

输入价格$0.150/M#21 / 180输出价格$0.500/M#21 / 180
输入价格
Input price
站内排名#21
分数$0.150/M
更新时间2026年8月27日
置信度4
输出价格
Output price
站内排名#21
分数$0.500/M
更新时间2026年8月27日
置信度4

智能体

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验

代码

V3.0

1 个指标 · 暂定评分

分数56.580% 区间40.5–72.41/4 实测维度SciCode46.1%#43 / 205
维度与证据
代码生成56.5
1 个基准族 · 1 个指标
scicode · scicode · z 0.73 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#43
分数46.1%
更新时间2026年8月27日
置信度4

综合推理

V3.0

2 个指标 · 暂定评分

分数60.780% 区间46.8–74.61/4 实测维度GPQA91.2%#21 / 212HLE39.9%#27 / 209
维度与证据
抽象逻辑仅先验
科学与因果推理60.7
2 个基准族 · 2 个指标
gpqa · gpqa · z 1.06 · q 1.00
hle · hle · z 0.93 · q 1.00
多步约束仅先验
证据整合与验证仅先验
GPQAV3 计分证据
站内排名#21
分数91.2%
更新时间2026年8月27日
置信度4
HLEV3 计分证据
站内排名#27
分数39.9%
更新时间2026年8月27日
置信度4

知识

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

替代方案与相似模型

别名

glm-5.3-flashz-ai/glm-5.3-flash

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。Artificial Analysis标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档