查模型跑分,测 API,选服务商
查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。
最新 100 分 API 安全检测
只展示最近 7 天内端点画像、模型真实性、Prompt 安全与响应完整性全部拿到 100 分的中转站检测报告。
- sub.callai.onegpt-5.6-sol报告时间8月18日报告时间8月18日848486100
- sub.callai.onegpt-5.6-sol报告时间8月18日报告时间8月18日707280100
- ai.databyte.co.iddatabyte-m1报告时间8月18日报告时间8月18日7284100100
- ai.databyte.co.iddeepseek-v4-flash报告时间8月18日报告时间8月18日10084100100
- ai.databyte.co.idMiniMax-M3报告时间8月18日报告时间8月18日768478100
- tokengate-cqt9ivzs.manus.spaceclaude-opus-5报告时间8月17日报告时间8月17日648465100
- router.bynara.idqwen-3.8-max-free报告时间8月17日报告时间8月17日846686100
- 87.120.187.161claude-fable-5报告时间8月17日报告时间8月17日72727273
- muyuan.doGLM-5.2报告时间8月17日报告时间8月17日768468100
- code28.ccwu.ccGPT-5.6 Terra报告时间8月17日报告时间8月17日848486100
最新、最强大模型跑分榜
聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。
| 模型 | 上下文 | 输入价 | 输出价 | 服务商 | Agents | 编程 | 推理 | 知识 | 数学 | 多语言 | 多模态 | 指令遵循 | 吞吐 | 延迟 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1Anthropic最新 | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +3 | 61.7±8.6 | 68.5±6.9 | 61.3±8.7 | 68±14.0P | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-09-01 |
| Claude Opus 5Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +85 | 65.9±7.7 | 67.5±6.6 | 59.5±8.7 | 66.9±14.0P | — | 64.3±17.1P | 56.7±16.4P | — | 吞吐 284 t/s | 延迟 5.44s | 发布日期2026-07-24 |
| Claude Fable 5Anthropic | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +122 | 63.1±8.2 | 66.5±6.9 | 60.9±10.8E | 64.9±14.0P | — | — | 44.8±16.4P | 50.4±16.0P | 吞吐 61 t/s | 延迟 3.92s | 发布日期2026-06-09 |
| GPT-6 AstraOpenAI最新 | 上下文1.1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +5 | 63±8.4 | 59.5±11.9E | 62.1±8.7 | 58±16.6P | 72.3±16.1P | — | 66.4±16.4P | — | 吞吐 — | 延迟 — | 发布日期2026-09-04 |
| Muse Spark 1.3Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 63.4±8.4 | 58.3±11.9E | 60.9±10.8E | 56.9±14.0P | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-09-02 |
| GLM 5.3Z.ai最新 | 上下文1.0M | 输入价$1.40/M | 输出价$4.40/M | 服务商 +16 | 51.3±20.2P | 62.9±16.0P | 60.9±13.9P | — | — | — | — | — | 吞吐 379 t/s | 延迟 30.00s | 发布日期2026-08-18 |
| Grok 4.6SpaceXAI最新 | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +20 | 60.8±8.4 | 58.6±11.9E | 59.5±10.8E | 60.2±14.0P | — | — | — | — | 吞吐 150 t/s | 延迟 22.76s | 发布日期2026-08-12 |
| Kimi K3MoonshotAI | 上下文1.0M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +88 | 65.7±7.3 | 56.4±11.9E | 60.2±10.8E | 59.4±14.0P | — | — | 64.9±11.3E | — | 吞吐 144 t/s | 延迟 29.69s | 发布日期2026-07-16 |
| GPT-5.6 SolOpenAI | 上下文1.1M | 输入价$4.00/M | 输出价$20.00/M | 服务商 +137 | 65±7.3 | 60.8±9.3E | 60.9±8.7 | 55.9±16.6P | 66±16.1P | — | 59.5±16.1P | 53.5±16.0P | 吞吐 53 t/s | 延迟 4.44s | 发布日期2026-07-09 |
| Claude Opus 4.8Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +156 | 61.8±5.5 | 64±6.6 | 56±8.7 | 62.1±14.0P | 57.2±16.1P | 55±17.1P | 59±12.0E | 50±16.0P | 吞吐 193 t/s | 延迟 4.02s | 发布日期2026-05-27 |
| GLM 5.3 FlashZ.ai最新 | 上下文1.3M | 输入价$0.150/M | 输出价$0.500/M | 服务商 +19 | 60.6±11.9E | 56.6±9.3E | 57.6±11.1E | 54.2±14.0P | — | — | 57.9±16.1P | — | 吞吐 338 t/s | 延迟 31.95s | 发布日期2026-08-26 |
| Gemini 3.8 FlashGoogle最新 | 上下文1.0M | 输入价$0.750/M | 输出价$3.75/M | 服务商 +2 | 59.9±11.3E | 58.8±11.9E | 59.8±10.8E | 61.3±14.0P | — | — | 54±16.4P | — | 吞吐 — | 延迟 — | 发布日期2026-09-02 |
| Claude Opus 4.7Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +198 | 53.7±6.9 | 58.5±11.2E | 54.8±10.8E | 53.6±14.0P | 56±16.1P | — | — | 44.5±16.0P | 吞吐 47 t/s | 延迟 4.89s | 发布日期2026-05-12 |
| Qwen3.8 MaxQwen | 上下文1M | 输入价$2.00/M | 输出价$6.00/M | 服务商 +29 | 61.5±10.9E | 61.7±11.2E | 63.5±10.1E | 52.2±14.0P | — | — | 64.3±6.3 | 57.9±16.0P | 吞吐 292 t/s | 延迟 4.31s | 发布日期2026-08-03 |
| Qwen3.8 2.4T A95BQwen最新 | 上下文1.0M | 输入价$2.00/M | 输出价$6.00/M | 服务商— | — | 59.3±16.0P | 62.1±13.9P | — | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-08-12 |
| Muse Spark 1.2Meta | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 +2 | 56.3±8.9 | 55.7±11.9E | 58.5±10.8E | 58.8±14.0P | — | — | — | — | 吞吐 69 t/s | 延迟 22.53s | 发布日期2026-08-05 |
查清模型能力,也验证背后的 API
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
- 模型跑分查询
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
- API 价格对比
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
- 实时速度基准测试
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
- API 安全性检测
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
- 自定义端点基准
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
- 速度基准分析
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
常见问题
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
如何查询模型跑分数据?
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
如何对比各服务商的大模型 API 价格?
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
哪些大模型 API 是免费的?
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 如何进行速度基准测试?
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
「检测这个 API 是否靠谱」会检查什么?
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
如何对比不同 API 服务商的速度?
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
是否支持长期性能监控?
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。
