查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。
只展示最近 7 天内端点画像、模型真实性、Prompt 安全与响应完整性全部拿到 100 分的中转站检测报告。
聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。
| 模型 | 上下文 | 输入价 | 输出价 | 服务商 | Agents | 编程 | 推理 | 知识 | 数学 | 多语言 | 多模态 | 指令遵循 | 吞吐 | 延迟 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5Anthropic最新 | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +73 | 67.5±8.2 | 70.1±6.6 | 60.6±8.7 | 67±14.0P | — | 64.3±17.1P | 58.5±17.0P | — | 吞吐 39 t/s | 延迟 5.06s | 发布日期2026-07-24 |
| Claude Fable 5Anthropic | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +114 | 65.7±8.2 | 68±6.9 | 60.8±10.8E | 61.1±14.0P | — | — | 46.2±17.0P | 50.4±16.0P | 吞吐 56 t/s | 延迟 3.67s | 发布日期2026-06-09 |
| Kimi K3MoonshotAI最新 | 上下文1.0M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +69 | 68.9±7.3 | 59.5±11.9E | 58.9±10.8E | 61.9±14.0P | — | — | 67.9±11.3E | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| Qwen3.8 MaxQwen最新 | 上下文1M | 输入价$2.00/M | 输出价$6.00/M | 服务商 +12 | 65.8±11.3E | 67.2±11.2E | 66±11.3E | 51.6±16.1P | — | — | 65.9±6.3 | 57.8±16.0P | 吞吐 — | 延迟 — | 发布日期2026-08-03 |
| GPT-5.6 SolOpenAI最新 | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +127 | 68.2±7.3 | 63.2±9.3E | 61.8±8.7 | 57.2±16.7P | 67±16.1P | — | 59.9±16.1P | 53.5±16.0P | 吞吐 44 t/s | 延迟 4.27s | 发布日期2026-07-09 |
| Claude Opus 4.8Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +148 | 63.2±5.3 | 66±6.6 | 56.8±8.7 | 64.4±14.0P | 58±16.1P | 55±17.1P | 61.6±12.0E | 50±16.0P | 吞吐 232 t/s | 延迟 2.21s | 发布日期2026-05-27 |
| GPT-5.5OpenAI | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +143 | 62.7±5.1 | 60±8.7 | 59.7±8.7 | 60.4±14.0P | 56.9±16.1P | — | 55.9±16.1P | 54.7±16.0P | 吞吐 46 t/s | 延迟 5.05s | 发布日期2026-04-24 |
| Muse Spark 1.2Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 62.3±16.0P | 64.5±16.0P | 61.8±13.9P | — | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-08-05 |
| Grok 4.5SpaceXAI最新 | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +99 | 61.9±8.4 | 58.9±6.9 | 54.6±8.7 | 58.1±14.0P | — | — | 48.5±17.0P | — | 吞吐 55 t/s | 延迟 8.64s | 发布日期2026-07-08 |
| Claude Opus 4.7Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +191 | 54.9±6.9 | 60.3±11.2E | 56.3±10.8E | 54.3±14.0P | 56.8±16.1P | — | — | 44.5±16.0P | 吞吐 47 t/s | 延迟 4.89s | 发布日期2026-05-12 |
| Claude Sonnet 5Anthropic | 上下文1M | 输入价$2.00/M | 输出价$10.00/M | 服务商 +104 | 59.8±8.2 | 59.1±6.6 | 56.5±10.8E | 61.7±14.0P | — | — | 60.3±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-06-30 |
| GPT-5.6 LunaOpenAI最新 | 上下文1.1M | 输入价$0.200/M | 输出价$1.20/M | 服务商 +120 | 59.8±7.4 | 56.9±9.3E | 54.9±8.7 | 56.5±16.7P | 62.4±16.1P | — | 50.2±16.1P | — | 吞吐 22 t/s | 延迟 18.05s | 发布日期2026-07-09 |
| GLM-5.2Z.ai | 上下文1.0M | 输入价$1.35/M | 输出价$4.29/M | 服务商 +135 | 60.5±7.2 | 54.4±8.9 | 54.7±10.8E | 58.7±14.0P | 70.8±11.5E | — | — | 53.7±16.0P | 吞吐 61 t/s | 延迟 7.79s | 发布日期2026-06-16 |
| Muse Spark 1.1Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 60.4±7.1 | 58±9.3E | 61.5±10.2E | 64.7±14.0P | — | — | 60.5±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| Gemini 3.5 FlashGoogle | 上下文1.0M | 输入价$1.50/M | 输出价$9.00/M | 服务商 +102 | 61.1±5.6 | 56.1±8.9 | 53.5±8.4 | 55.4±14.0P | 55.1±16.1P | — | 57.3±11.9E | 54.9±16.0P | 吞吐 425 t/s | 延迟 4.10s | 发布日期2026-05-19 |
| Gemini 3.6 FlashGoogle最新 | 上下文1.0M | 输入价$1.50/M | 输出价$7.50/M | 服务商 +58 | 53±9.0 | 54.7±11.9E | 59±10.8E | 58±14.0P | — | — | 51.3±17.0P | — | 吞吐 — | 延迟 — | 发布日期2026-07-21 |
对比各 API 服务商的价格、速度基准与性能数据。
统一的API网关,提供对多种大语言模型的访问,支持国内直连。
健康状态
100%
测试次数
145
最近检查
Aug 6
API 价格
暂无健康检测
健康状态
100%
测试次数
5
最近检查
Aug 6
API 价格
暂无健康检测
健康状态
100%
测试次数
5
最近检查
Aug 6
API 价格
暂无健康检测
健康状态
99%
测试次数
15
最近检查
Aug 6
API 价格
暂无健康检测
健康状态
100%
测试次数
20
最近检查
Aug 6
API 价格
暂无健康检测
Cuz AI runs an OpenAI-compatible relay at ai.cuz-lab.space with broad model coverage, public pricing, and stable throughput for chat and coding workloads.
DeepSeek 提供其最新大语言模型的 API 访问,用于文本生成和编程任务。
健康状态
100%
测试次数
692
最近检查
Aug 6
API 价格
暂无健康检测
虾米API是一个统一的LLM API网关,提供对多种AI模型的访问,具有竞争性定价和稳定性能。
健康状态
86%
测试次数
10
最近检查
Aug 6
API 价格
暂无健康检测
NVIDIA NIM 通过 NVIDIA 云基础设施提供优化的 AI 模型推理 API,支持大语言模型、视觉和向量模型。
健康状态
100%
测试次数
1,189
最近检查
Aug 6
API 价格
暂无健康检测
Kilo 提供开源编码代理和 AI 助手平台,支持 500 多种模型,并集成多种开发工具和环境。
健康状态
100%
测试次数
40
最近检查
Aug 6
API 价格
暂无健康检测
CCTQ(code.b886.top)提供 OpenAI 兼容 API 中转,统一接入多种大语言模型。
健康状态
0%
测试次数
15
最近检查
Aug 6
API 价格
暂无健康检测
6345ywz API 是 OpenAI 兼容的 API 中转服务,以有竞争力的价格提供多种 AI 模型访问。
健康状态
99%
测试次数
360
最近检查
Aug 6
API 价格
暂无健康检测