大模型 API 基准测试
用同一组五轮提示词测试任意兼容端点,对比开始输出前的等待、持续生成速度与完整响应耗时。
Speedtest 测什么
LMSpeed 会向模型发送五轮标准提示词,从首个 Token 到响应结束持续记录。这样可以把连接与排队造成的等待,和模型持续生成的速度分开看。
这些数据有什么用
用可比的结果发现慢速中转线路,在接入前评估不同服务商,并选择真正能让用户感觉流畅的 API 端点。
查看社区近期测速样本,对比不同服务商的首字延迟与输出速度。
| 时间 | 提供商 | 模型 | 速度 | 延迟 |
|---|---|---|---|---|
| 8月15日 03:05 | mishradev.com | claude-sonnet-5 | 85.74t/s | 2.74s |
| 8月14日 18:31 | open.bigmodel.cn | glm-5.3 | 420.40t/s | 27.86s |
| 8月14日 14:55 | integrate.api.nvidia.com | stepfun-ai/step-3.7-flash | 267.40t/s | 37.55s |
| 8月14日 14:55 | integrate.api.nvidia.com | meta/muse-glimmer-30b | 118.96t/s | 4.57s |
| 8月14日 14:53 | integrate.api.nvidia.com | meta/muse-glimmer-30b | 129.74t/s | 5.10s |
从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。
在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。
对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。
用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。
检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。
输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。
查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。
了解模型跑分、价格对比、测速和 API 安全检测如何使用。
可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。
LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。
许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。
LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。
它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。
使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。
Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。