查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。
只展示最近 7 天内端点画像、模型真实性、Prompt 安全与响应完整性全部拿到 100 分的中转站检测报告。
聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。
| 模型 | 上下文 | 输入价 | 输出价 | 服务商 | Agents | 编程 | 推理 | 知识 | 数学 | 多语言 | 多模态 | 指令遵循 | 吞吐 | 延迟 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5Anthropic最新 | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +67 | 67.4±8.3 | 68.8±6.6 | 60.6±8.7 | 66.5±14.0P | — | 64.3±17.1P | 59.2±17.0P | — | 吞吐 — | 延迟 — | 发布日期2026-07-24 |
| Claude Fable 5Anthropic | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +113 | 66.3±8.2 | 67.8±6.9 | 61±10.8E | 60.8±14.0P | — | — | 45.6±17.0P | 50.6±16.0P | 吞吐 58 t/s | 延迟 3.77s | 发布日期2026-06-09 |
| Kimi K3MoonshotAI最新 | 上下文1.0M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +63 | 69.4±7.3 | 61.1±11.9E | 61.7±10.8E | 61.5±14.0P | — | — | 69.7±11.3E | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| GPT-5.6 SolOpenAI最新 | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +123 | 68±7.3 | 62.5±9.3E | 61.7±8.7 | 57.2±16.7P | 67±16.1P | — | 60.9±16.1P | 53.9±16.0P | 吞吐 53 t/s | 延迟 2.16s | 发布日期2026-07-09 |
| Claude Opus 4.8Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +145 | 63.5±5.3 | 65.7±6.6 | 56.7±8.7 | 63.9±14.0P | 58±16.1P | 55±17.1P | 62.7±12.0E | 50.2±16.0P | 吞吐 232 t/s | 延迟 2.21s | 发布日期2026-05-27 |
| GPT-5.5OpenAI | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +136 | 62.9±5.1 | 60.1±8.7 | 59.6±8.7 | 60±14.0P | 56.9±16.1P | — | 56.4±16.1P | 55.1±16.0P | 吞吐 45 t/s | 延迟 5.42s | 发布日期2026-04-24 |
| Grok 4.5xAI最新 | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +95 | 62.4±8.4 | 59±6.9 | 54.5±8.7 | 57.9±14.0P | — | — | 48.5±17.0P | — | 吞吐 54 t/s | 延迟 5.37s | 发布日期2026-07-08 |
| Claude Opus 4.7Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +187 | 55±6.9 | 60.5±11.2E | 56.5±10.8E | 53.7±14.0P | 56.8±16.1P | — | — | 44.5±16.0P | 吞吐 47 t/s | 延迟 4.89s | 发布日期2026-05-12 |
| Claude Sonnet 5Anthropic最新 | 上下文1M | 输入价$2.00/M | 输出价$10.00/M | 服务商 +101 | 60.7±8.2 | 59.3±6.6 | 56.6±10.8E | 61.3±14.0P | — | — | 62.3±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-06-30 |
| GPT-5.6 LunaOpenAI最新 | 上下文1.1M | 输入价$1.00/M | 输出价$6.00/M | 服务商 +115 | 60.5±7.4 | 57.2±9.3E | 54.9±8.7 | 56.5±16.7P | 62.4±16.1P | — | 50.1±16.1P | — | 吞吐 — | 延迟 — | 发布日期2026-07-09 |
| GLM-5.2Z.ai | 上下文1.0M | 输入价$1.40/M | 输出价$4.40/M | 服务商 +132 | 61±7.2 | 58.1±8.9 | 54.9±10.8E | 58.3±14.0P | 70.4±11.5E | — | — | 54.1±16.0P | 吞吐 61 t/s | 延迟 7.79s | 发布日期2026-06-16 |
| Muse Spark 1.1Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 61.4±7.1 | 58.6±9.3E | 61.7±10.2E | 64.2±14.0P | — | — | 62.5±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| Gemini 3.5 FlashGoogle | 上下文1.0M | 输入价$1.50/M | 输出价$9.00/M | 服务商 +98 | 61.3±5.6 | 56.1±8.9 | 53.4±8.4 | 55.2±14.0P | 55.1±16.1P | — | 58.5±11.9E | 55.3±16.0P | 吞吐 425 t/s | 延迟 4.10s | 发布日期2026-05-19 |
| Gemini 3.6 FlashGoogle最新 | 上下文1.0M | 输入价$1.50/M | 输出价$7.50/M | 服务商 +52 | 54.1±9.0 | 56.3±11.9E | 59.1±10.8E | 57.9±14.0P | — | — | 51.6±17.0P | — | 吞吐 — | 延迟 — | 发布日期2026-07-21 |
| Claude Sonnet 4.6Anthropic | 上下文1M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +213 | 53.6±6.1 | 56.2±8.6 | 50.2±8.7 | 70.6±16.3P | 53.2±16.1P | — | 44.5±16.2P | 43.8±16.0P | 吞吐 43 t/s | 延迟 4.13s | 发布日期2026-02-17 |
| Gemini 3.1 Pro PreviewGoogle | 上下文1.0M | 输入价$2.00/M | 输出价$12.00/M | 服务商 +11 | — | 66.5±16.0P | 64.6±13.9P | — | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-02-19 |
对比各 API 服务商的价格、速度基准与性能数据。
统一的API网关,提供对多种大语言模型的访问,支持国内直连。
健康状态
100%
测试次数
145
最近检查
Jul 30
API 价格
暂无健康检测
健康状态
98%
测试次数
10
最近检查
Jul 30
API 价格
暂无健康检测
健康状态
100%
测试次数
45
最近检查
Jul 30
API 价格
暂无健康检测
健康状态
100%
测试次数
15
最近检查
Jul 30
API 价格
暂无健康检测
DeepSeek 提供其最新大语言模型的 API 访问,用于文本生成和编程任务。
健康状态
100%
测试次数
627
最近检查
Jul 30
API 价格
暂无健康检测
OpenCode 是一个开源的 AI 编码助手,支持在终端、IDE 和桌面应用中集成,兼容多种模型和提供商。
健康状态
100%
测试次数
145
最近检查
Jul 30
API 价格
暂无健康检测
提供文本生成、代码编写、逻辑推理和多模态能力的大型语言模型API。
健康状态
100%
测试次数
118
最近检查
Jul 30
API 价格
暂无健康检测
xAI 通过其 API 提供 Grok 系列 AI 模型,支持文本生成和多模态能力。
健康状态
69%
测试次数
45
最近检查
Jul 30
API 价格
暂无健康检测
NVIDIA NIM 通过 NVIDIA 云基础设施提供优化的 AI 模型推理 API,支持大语言模型、视觉和向量模型。
健康状态
100%
测试次数
1,184
最近检查
Jul 30
API 价格
暂无健康检测
Hanbing API 是社区公益中转站,支持每日签到奖励,适合 LLM 与酒馆聊天场景;不支持 OpenClaw、Codex 等高消耗工具。
健康状态
100%
测试次数
40
最近检查
Jul 30
API 价格
暂无健康检测
CM-API 公益站由 LinuxDO 用户 chengmo 搭建,单次 0.01 刀,以 Grok、Kimi、Qwen 为主,支持沉浸式翻译与 LDC。
健康状态
100%
测试次数
5
最近检查
Jul 30
API 价格
暂无健康检测
ChooseC API 是统一的 AI 模型聚合网关,一站接入 Claude、GPT、Qwen、DeepSeek、Kimi、GLM 等 260+ 主流大模型,全面兼容 OpenAI / Claude / Gemini 接口。
健康状态
100%
测试次数
110
最近检查
Jul 30
API 价格
暂无健康检测