查看 Agent、Coding 和 Reasoning 模型跑分, 对比服务商单价、免费额度与模型覆盖, 测量 API 延迟、吞吐和耗时,并 检测模型真实性、Prompt 与错误泄漏风险。
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。
只展示最近 7 天内端点画像、模型真实性、Prompt 安全与响应完整性全部拿到 100 分的中转站检测报告。
聚合 LMSpeed 最新收录模型与高分模型,聚焦 Artificial Analysis 的综合、编程和数学跑分。
| 模型 | 上下文 | 输入价 | 输出价 | 服务商 | Agents | 编程 | 推理 | 知识 | 数学 | 多语言 | 多模态 | 指令遵循 | 吞吐 | 延迟 | 发布日期 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5Anthropic最新 | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +69 | 67.4±8.3 | 69.8±6.6 | 60.7±8.7 | 66.6±14.0P | — | 64.3±17.1P | 58.6±17.0P | — | 吞吐 39 t/s | 延迟 5.06s | 发布日期2026-07-24 |
| Claude Fable 5Anthropic | 上下文1M | 输入价$10.00/M | 输出价$50.00/M | 服务商 +113 | 66.4±8.2 | 68±6.9 | 60.9±10.8E | 60.8±14.0P | — | — | 45.8±17.0P | 50.5±16.0P | 吞吐 58 t/s | 延迟 3.77s | 发布日期2026-06-09 |
| Kimi K3MoonshotAI最新 | 上下文1.0M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +66 | 69.4±7.3 | 59.3±11.9E | 59±10.8E | 61.6±14.0P | — | — | 70.5±11.3E | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| GPT-5.6 SolOpenAI最新 | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +124 | 68.2±7.3 | 63.1±9.3E | 61.8±8.7 | 57.2±16.7P | 67±16.1P | — | 60.1±16.1P | 53.6±16.0P | 吞吐 50 t/s | 延迟 3.82s | 发布日期2026-07-09 |
| Claude Opus 4.8Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +145 | 63.5±5.3 | 66.1±6.6 | 56.8±8.7 | 64±14.0P | 58±16.1P | 55±17.1P | 63.5±12.0E | 50.1±16.0P | 吞吐 232 t/s | 延迟 2.21s | 发布日期2026-05-27 |
| GPT-5.5OpenAI | 上下文1.1M | 输入价$5.00/M | 输出价$30.00/M | 服务商 +138 | 62.9±5.1 | 60.1±8.7 | 59.7±8.7 | 60±14.0P | 56.9±16.1P | — | 56.1±16.1P | 54.8±16.0P | 吞吐 44 t/s | 延迟 5.35s | 发布日期2026-04-24 |
| Grok 4.5xAI最新 | 上下文500K | 输入价$2.00/M | 输出价$6.00/M | 服务商 +95 | 62.5±8.4 | 59.2±6.9 | 54.6±8.7 | 57.9±14.0P | — | — | 48.6±17.0P | — | 吞吐 55 t/s | 延迟 8.64s | 发布日期2026-07-08 |
| Claude Opus 4.7Anthropic | 上下文1M | 输入价$5.00/M | 输出价$25.00/M | 服务商 +188 | 55±6.9 | 60.5±11.2E | 56.4±10.8E | 53.6±14.0P | 56.8±16.1P | — | — | 44.6±16.0P | 吞吐 47 t/s | 延迟 4.89s | 发布日期2026-05-12 |
| Claude Sonnet 5Anthropic | 上下文1M | 输入价$2.00/M | 输出价$10.00/M | 服务商 +101 | 60.8±8.2 | 59.4±6.6 | 56.6±10.8E | 61.4±14.0P | — | — | 63.4±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-06-30 |
| GPT-5.6 LunaOpenAI最新 | 上下文1.1M | 输入价$0.200/M | 输出价$1.20/M | 服务商 +116 | 60.5±7.4 | 57.4±9.3E | 55±8.7 | 56.5±16.7P | 62.4±16.1P | — | 50.4±16.1P | — | 吞吐 — | 延迟 — | 发布日期2026-07-09 |
| GLM-5.2Z.ai | 上下文1.0M | 输入价$1.40/M | 输出价$4.40/M | 服务商 +133 | 61±7.2 | 55.8±8.9 | 54.9±10.8E | 58.3±14.0P | 70.5±11.5E | — | — | 53.8±16.0P | 吞吐 61 t/s | 延迟 7.79s | 发布日期2026-06-16 |
| Muse Spark 1.1Meta最新 | 上下文1.0M | 输入价$1.25/M | 输出价$4.25/M | 服务商 | 61.2±7.1 | 58.6±9.3E | 61.5±10.2E | 64.4±14.0P | — | — | 63.6±16.2P | — | 吞吐 — | 延迟 — | 发布日期2026-07-16 |
| Gemini 3.5 FlashGoogle | 上下文1.0M | 输入价$1.50/M | 输出价$9.00/M | 服务商 +99 | 61.3±5.6 | 56.1±8.9 | 53.6±8.4 | 55±14.0P | 55.1±16.1P | — | 58.2±11.9E | 55±16.0P | 吞吐 425 t/s | 延迟 4.10s | 发布日期2026-05-19 |
| Gemini 3.6 FlashGoogle最新 | 上下文1.0M | 输入价$1.50/M | 输出价$7.50/M | 服务商 +55 | 54.2±9.0 | 55.9±11.9E | 59.1±10.8E | 57.8±14.0P | — | — | 51.5±17.0P | — | 吞吐 — | 延迟 — | 发布日期2026-07-21 |
| Claude Sonnet 4.6Anthropic | 上下文1M | 输入价$3.00/M | 输出价$15.00/M | 服务商 +213 | 53.4±6.1 | 56.1±8.6 | 50.3±8.7 | 70.6±16.3P | 53.2±16.1P | — | 43.8±16.2P | 43.9±16.0P | 吞吐 43 t/s | 延迟 4.13s | 发布日期2026-02-17 |
| Gemini 3.1 Pro PreviewGoogle | 上下文1.0M | 输入价$2.00/M | 输出价$12.00/M | 服务商 +11 | — | 66.5±16.0P | 64.5±13.9P | — | — | — | — | — | 吞吐 — | 延迟 — | 发布日期2026-02-19 |
对比各 API 服务商的价格、速度基准与性能数据。
统一的API网关,提供对多种大语言模型的访问,支持国内直连。
健康状态
100%
测试次数
145
最近检查
Aug 3
API 价格
暂无健康检测
健康状态
99%
测试次数
15
最近检查
Aug 3
API 价格
暂无健康检测
健康状态
100%
测试次数
20
最近检查
Aug 3
API 价格
暂无健康检测
Cuz AI runs an OpenAI-compatible relay at ai.cuz-lab.space with broad model coverage, public pricing, and stable throughput for chat and coding workloads.
DeepSeek 提供其最新大语言模型的 API 访问,用于文本生成和编程任务。
健康状态
100%
测试次数
657
最近检查
Aug 3
API 价格
暂无健康检测
6345ywz API 是 OpenAI 兼容的 API 中转服务,以有竞争力的价格提供多种 AI 模型访问。
健康状态
99%
测试次数
360
最近检查
Aug 3
API 价格
暂无健康检测
OpenCode 是一个开源的 AI 编码助手,支持在终端、IDE 和桌面应用中集成,兼容多种模型和提供商。
健康状态
100%
测试次数
220
最近检查
Aug 3
API 价格
暂无健康检测
月之暗面提供基于大语言模型的AI服务,包括Kimi智能助手和开放平台,支持搜索、推理和长文本对话等任务。
健康状态
78%
测试次数
85
最近检查
Aug 3
API 价格
暂无健康检测
智谱 AI 提供 GLM 系列大语言模型,包括 GLM-4、ChatGLM 和 CodeGeeX,支持文本、代码和多模态任务。
健康状态
100%
测试次数
395
最近检查
Aug 3
API 价格
暂无健康检测
健康状态
99%
测试次数
10
最近检查
Aug 3
API 价格
暂无健康检测
健康状态
100%
测试次数
45
最近检查
Aug 3
API 价格
暂无健康检测
VSLLM 是基于 New API 搭建的 AI 网关,在 vsllm.com 通过单一端点聚合多种模型访问。
健康状态
100%
测试次数
150
最近检查
Aug 3
API 价格
暂无健康检测