查模型跑分,测 API,选服务商

查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。

赞助商

感谢这些伙伴支持 LMSpeed 持续提供独立的模型与 API 服务商评测。

最新、最强大模型跑分榜

聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。

模型上下文输入价输出价服务商Agents编程推理知识数学多语言多模态指令遵循吞吐延迟发布日期
Claude Fable 5.1Anthropic最新上下文1M输入价$10.00/M输出价$50.00/M服务商
+3
61.7±8.6
68.5±6.9
61.3±8.7
68±14.0P
吞吐
延迟
发布日期2026-09-01
Claude Opus 5Anthropic上下文1M输入价$5.00/M输出价$25.00/M服务商
+85
65.9±7.7
67.5±6.6
59.5±8.7
66.9±14.0P
64.3±17.1P
56.7±16.4P
吞吐
284 t/s
延迟
5.44s
发布日期2026-07-24
Claude Fable 5Anthropic上下文1M输入价$10.00/M输出价$50.00/M服务商
+122
63.1±8.2
66.5±6.9
60.9±10.8E
64.9±14.0P
44.8±16.4P
50.4±16.0P
吞吐
61 t/s
延迟
3.92s
发布日期2026-06-09
GPT-6 AstraOpenAI最新上下文1.1M输入价$10.00/M输出价$50.00/M服务商
+5
63±8.4
59.5±11.9E
62.1±8.7
58±16.6P
72.3±16.1P
66.4±16.4P
吞吐
延迟
发布日期2026-09-04
Muse Spark 1.3Meta最新上下文1.0M输入价$1.25/M输出价$4.25/M服务商
63.4±8.4
58.3±11.9E
60.9±10.8E
56.9±14.0P
吞吐
延迟
发布日期2026-09-02
GLM 5.3Z.ai最新上下文1.0M输入价$1.40/M输出价$4.40/M服务商
+16
51.3±20.2P
62.9±16.0P
60.9±13.9P
吞吐
379 t/s
延迟
30.00s
发布日期2026-08-18
Grok 4.6SpaceXAI最新上下文500K输入价$2.00/M输出价$6.00/M服务商
+20
60.8±8.4
58.6±11.9E
59.5±10.8E
60.2±14.0P
吞吐
150 t/s
延迟
22.76s
发布日期2026-08-12
Kimi K3MoonshotAI上下文1.0M输入价$3.00/M输出价$15.00/M服务商
+88
65.7±7.3
56.4±11.9E
60.2±10.8E
59.4±14.0P
64.9±11.3E
吞吐
144 t/s
延迟
29.69s
发布日期2026-07-16
GPT-5.6 SolOpenAI上下文1.1M输入价$4.00/M输出价$20.00/M服务商
+137
65±7.3
60.8±9.3E
60.9±8.7
55.9±16.6P
66±16.1P
59.5±16.1P
53.5±16.0P
吞吐
53 t/s
延迟
4.44s
发布日期2026-07-09
Claude Opus 4.8Anthropic上下文1M输入价$5.00/M输出价$25.00/M服务商
+156
61.8±5.5
64±6.6
56±8.7
62.1±14.0P
57.2±16.1P
55±17.1P
59±12.0E
50±16.0P
吞吐
193 t/s
延迟
4.02s
发布日期2026-05-27
GLM 5.3 FlashZ.ai最新上下文1.3M输入价$0.150/M输出价$0.500/M服务商
+19
60.6±11.9E
56.6±9.3E
57.6±11.1E
54.2±14.0P
57.9±16.1P
吞吐
338 t/s
延迟
31.95s
发布日期2026-08-26
Gemini 3.8 FlashGoogle最新上下文1.0M输入价$0.750/M输出价$3.75/M服务商
+2
59.9±11.3E
58.8±11.9E
59.8±10.8E
61.3±14.0P
54±16.4P
吞吐
延迟
发布日期2026-09-02
Claude Opus 4.7Anthropic上下文1M输入价$5.00/M输出价$25.00/M服务商
+198
53.7±6.9
58.5±11.2E
54.8±10.8E
53.6±14.0P
56±16.1P
44.5±16.0P
吞吐
47 t/s
延迟
4.89s
发布日期2026-05-12
Qwen3.8 MaxQwen上下文1M输入价$2.00/M输出价$6.00/M服务商
+29
61.5±10.9E
61.7±11.2E
63.5±10.1E
52.2±14.0P
64.3±6.3
57.9±16.0P
吞吐
292 t/s
延迟
4.31s
发布日期2026-08-03
Qwen3.8 2.4T A95BQwen最新上下文1.0M输入价$2.00/M输出价$6.00/M服务商
59.3±16.0P
62.1±13.9P
吞吐
延迟
发布日期2026-08-12
Muse Spark 1.2Meta上下文1.0M输入价$1.25/M输出价$4.25/M服务商
+2
56.3±8.9
55.7±11.9E
58.5±10.8E
58.8±14.0P
吞吐
69 t/s
延迟
22.53s
发布日期2026-08-05

查清模型能力,也验证背后的 API

从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。

模型跑分查询

在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。

API 价格对比

对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。

实时速度基准测试

用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。

API 安全性检测

检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。

自定义端点基准

输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。

速度基准分析

查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。

常见问题

了解模型跑分、价格对比、测速和 API 安全检测如何使用。

如何查询模型跑分数据?

可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。

如何对比各服务商的大模型 API 价格?

LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。

哪些大模型 API 是免费的?

许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。

LMSpeed 如何进行速度基准测试?

LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。

「检测这个 API 是否靠谱」会检查什么?

它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。

如何对比不同 API 服务商的速度?

使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。

是否支持长期性能监控?

Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。