智谱 AI 提供 GLM 系列大语言模型,包括 GLM-4、ChatGLM 和 CodeGeeX,支持文本、代码和多模态任务。

模型
34 个
最低
--
速度
68 tok/s
更新
7/8/2026
延迟
0.00 s
创建时间
8/13/2025

API 地址

  • 接口 1
    open.bigmodel.cn
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 智谱 AI

智谱 AI 是国内领先的 AI 公司,提供 GLM 系列大语言模型的开放平台。包括 GLM-4(旗舰对话模型)、GLM-4V(多模态理解)、CodeGeeX(代码生成)等模型,支持文本生成、图像理解、代码辅助、知识检索等能力。广泛应用于智能对话、内容创作和企业级 AI 开发。

健康检查

100%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 26 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
速度
延迟
239.3 t/s35.37 s
420.4 t/s27.86 s
44.7 t/s9.68 s
66.6 t/s0.39 s
27.5 t/s0.43 s
34.9 t/s17.51 s
58.1 t/s14.60 s
36.7 t/s26.39 s
44.7 t/s22.27 s
69.0 t/s12.70 s
137.1 t/s9.86 s
41.6 t/s24.44 s
28.0 t/s0.51 s
46.3 t/s0.36 s
65.3 t/s0.43 s
95.7 t/s7.10 s
70.7 t/s11.56 s
40.1 t/s16.54 s
69.3 t/s12.39 s
52.7 t/s0.30 s
168.2 t/s0.34 s
125.1 t/s0.34 s
35.9 t/s37.31 s
68.5 t/s2.58 s
51.6 t/s9.63 s

当前显示 25 / 26 个模型行

最近测试记录

时间模型速度延迟
Aug 28, 10:35 PM
glm-5.3-flash
216.83 tok/s
39.60s
Aug 28, 09:54 PM
glm-5.3-flash
262.55 tok/s
33.74s
Aug 27, 07:07 AM
glm-5.3-flash
235.34 tok/s
22.31s
Aug 14, 06:31 PM
glm-5.3
420.40 tok/s
27.86s
Aug 7, 10:22 PM
GLM-4-Flash-250414
43.99 tok/s
1.02s
Aug 1, 11:49 PM
glm-4.7-flash
99.16 tok/s
7.32s
Jun 28, 06:36 AM
glm-4.7-flash
111.48 tok/s
7.30s
Jun 27, 06:54 PM
glm-4.7-flash
56.19 tok/s
15.97s
Jun 21, 08:35 PM
glm-5.2
48.64 tok/s
9.73s
Jun 17, 05:17 AM
glm-5.2
40.66 tok/s
9.64s

相似 API 替代服务商对比

用 160 个 LMSpeed 信号,把 智谱 AI 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
智谱 AI

zhipu-ai

Zhipu AI provides the GLM series of large language models including GLM-4, ChatGLM, and CodeGeeX for text, code, and multimodal tasks.

当前服务商基线340N/A68 tok/s9970%
阿里云百炼 DashScope

dashscope

Alibaba Cloud DashScope provides AI model APIs including Qwen LLMs, vision, audio, and embedding models.

  • 实测速度更快
  • 模型覆盖更广
  • 同分类服务商
2960N/A77 tok/s7730%
百度千帆

baidu-qianfan

Baidu Qianfan is Baidu Intelligent Clouds enterprise AI platform, providing access to ERNIE series models and other LLM capabilities through developer APIs.

  • 实测速度更快
  • 模型覆盖更广
  • 同分类服务商
1840N/A81 tok/s4830%
Mistral AI

mistral-ai-api

Mistral AI API provides access to frontier AI models including Mistral Large, Medium, Small, and Codestral for chat, code, and embeddings.

  • 实测速度更快
  • 30 天可用性更高
  • 同分类服务商
110N/A132 tok/s9980%
火山引擎 Ark

volcengine-ark

Volcengine Ark is ByteDance's enterprise AI platform, offering Doubao series models and third-party LLMs via OpenAI-compatible API.

  • 模型覆盖更广
  • 同分类服务商
1630N/A41 tok/s9960%
GLM BigModel Relay

glm-bigmodel-relay

A third-party API relay providing access to GLM/ChatGLM models through OpenAI-compatible endpoints.

  • 模型覆盖更广
  • 同分类服务商
1400$0.0083/M52 tok/s9970%
共绩算力(算了么 API)

api-suanli-cn

Gongji Compute (共绩算力) provides pay-as-you-go, standard API access to mainstream LLMs and elastic GPU computing for AI applications.

  • 免费模型更多
  • 同分类服务商
155N/A36 tok/s5600%

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。