赞助推荐Fusecode面向 Claude Code、Codex 与模型工作流的企业级编程 API 服务。
LogoLM Speed
  • 模型
  • 提供商
  • 免费 API
  • 排行榜
LogoLM Speed
  1. 首页
  2. 测速
LogoLMSpeed

专业的 LLM API 速度测试工具

GitHubGitHubTwitterX (Twitter)Email
产品
  • 功能
  • 价格
  • 常见问题
排行榜
  • 总览
  • 速度排行
  • 延迟排行
  • 健康度排行
  • 模型价格
  • 模型速度
  • 推理能力
  • 代码能力
模型
  • 全部模型
  • GPT
  • Claude
  • Gemini
  • DeepSeek
  • Llama
  • Qwen
免费模型
  • 全部免费模型
  • 免费 GPT
  • 免费 Claude
  • 免费 Gemini
  • 免费 DeepSeek
  • 免费 Llama
  • 免费 Qwen
工具
  • 速度测试
  • 服务商审计
公司
  • 关于我们
资源
  • 服务商目录
  • 文档
  • 公共 API
  • Botab
  • VidBee
法律
  • Cookie政策
  • 隐私政策
  • 服务条款
© 2026 LM Speed All Rights Reserved.Made by Nexmoe with ❤️

大模型 API 基准测试

测清你的 AI API 到底有多快

用同一组五轮提示词测试任意兼容端点,对比开始输出前的等待、持续生成速度与完整响应耗时。

Speedtest 测什么

既测开始前的等待,也测输出后的速度

LMSpeed 会向模型发送五轮标准提示词,从首个 Token 到响应结束持续记录。这样可以把连接与排队造成的等待,和模型持续生成的速度分开看。

这些数据有什么用

用可比的结果发现慢速中转线路,在接入前评估不同服务商,并选择真正能让用户感觉流畅的 API 端点。

01首字延迟
用户从发出请求到看到第一个 Token 要等多久。聊天和交互产品中越低越好。
02输出吞吐量
开始输出后每秒生成多少 Token。数值越高,长回答完成得越快。
03完整响应耗时
每轮标准回答从请求到结束的总时间,同时包含启动等待与生成过程。

最近测试记录

查看社区近期测速样本,对比不同服务商的首字延迟与输出速度。

时间提供商模型速度延迟
8月15日 03:05mishradev.com
claude-sonnet-5
85.74t/s
2.74s
8月14日 18:31open.bigmodel.cn
glm-5.3
420.40t/s
27.86s
8月14日 14:55integrate.api.nvidia.com
stepfun-ai/step-3.7-flash
267.40t/s
37.55s
8月14日 14:55integrate.api.nvidia.com
meta/muse-glimmer-30b
118.96t/s
4.57s
8月14日 14:53integrate.api.nvidia.com
meta/muse-glimmer-30b
129.74t/s
5.10s

查清模型能力,也验证背后的 API

从模型跑分查询开始,再对比按 token 价格、五轮测速、健康检查和安全探针,判断一个 API 能不能进项目。

模型跑分查询

在首页直接搜索模型名,进入模型目录和详情页,查看 AA 综合、编程、数学跑分和模型元信息。

API 价格对比

对比 100+ 家服务商的按 token 计费价格,找到每个模型更便宜的 API,并追踪免费额度与免费套餐。

实时速度基准测试

用标准提示词做五轮连续测速,测量首字延迟、输出吞吐量和每轮响应耗时。

API 安全性检测

检测任意 OpenAI 兼容 API 的模型真实性、隐藏 Prompt、指令篡改、流式完整性和错误泄漏,并生成可分享的人话报告。

自定义端点基准

输入 Base URL、API Key 与模型 ID,即可测试官方、代理、中转或自部署端点。

速度基准分析

查看首字延迟、输出吞吐量、总耗时、健康度与近期探测信号,判断性能是否稳定。

常见问题

了解模型跑分、价格对比、测速和 API 安全检测如何使用。

如何查询模型跑分数据?

可以直接使用首页的模型搜索框,也可以打开「模型跑分榜」。输入模型名称后进入模型目录或详情页,查看 AA 综合、编程、数学等跑分,并结合模型元信息继续筛选。

如何对比各服务商的大模型 API 价格?

LMSpeed 汇集了 100+ 家 API 服务商的按 token 计费价格。访问任意模型页面即可查看各服务商的输入输出价格对比表,快速找到每个模型最便宜的服务商。

哪些大模型 API 是免费的?

许多服务商为 DeepSeek、Gemini、Llama 等热门模型提供免费 API 额度或免费套餐。查看我们的免费大模型 API 汇总页面,获取完整的免费模型列表及各服务商的速度基准数据。

LMSpeed 如何进行速度基准测试?

LMSpeed 采用五轮连续压力测试机制和标准化提示词。通过 tiktoken 进行精确的 token 计算,测量输出吞吐量(tok/s)和首字延迟。

「检测这个 API 是否靠谱」会检查什么?

它会对 OpenAI 兼容端点发送多轮安全探针,检查模型身份是否匹配、是否注入隐藏 system prompt、是否改写用户指令、流式响应是否完整、错误信息是否泄漏敏感实现;完成后生成风险分和可分享报告。API Key 只用于本次检测,不会写入公开报告。

如何对比不同 API 服务商的速度?

使用我们的性能排行榜和模型详情页,直观对比各服务商的 API 速度基准。系统按吞吐量、延迟和健康度排名,帮您找到最快最稳定的 API。

是否支持长期性能监控?

Provider 详情页和健康排行榜已经展示近期健康检查、探测延迟、成功/失败状态和稳定性排行。更完整的持续监控与告警能力会继续扩展。