赞助推荐Fusecode面向 Claude Code、Codex 与模型工作流的企业级编程 API 服务。
LogoLM Speed
  • 模型
  • 提供商
  • 免费 API
  • 排行榜
LogoLM Speed
  1. 首页
  2. 服务商
  3. Router Huggingface Co
LogoLMSpeed

专业的 LLM API 速度测试工具

GitHubGitHubTwitterX (Twitter)Email
产品
  • 功能
  • 价格
  • 常见问题
排行榜
  • 总览
  • 速度排行
  • 延迟排行
  • 健康度排行
  • 模型价格
  • 模型速度
  • 推理能力
  • 代码能力
模型
  • 全部模型
  • GPT
  • Claude
  • Gemini
  • DeepSeek
  • Llama
  • Qwen
免费模型
  • 全部免费模型
  • 免费 GPT
  • 免费 Claude
  • 免费 Gemini
  • 免费 DeepSeek
  • 免费 Llama
  • 免费 Qwen
工具
  • 速度测试
  • 服务商审计
公司
  • 关于我们
资源
  • 服务商目录
  • 文档
  • 公共 API
  • Botab
  • VidBee
法律
  • Cookie政策
  • 隐私政策
  • 服务条款
© 2026 LM Speed All Rights Reserved.Made by Nexmoe with ❤️

Hugging Face

网站X (Twitter)分享到 X

router.huggingface.co

Hugging Face Router 提供跨推理供应商的智能模型路由,通过兼容 OpenAI 的 API 访问开源模型。

模型
8 个
最低
--
速度
138 tok/s
更新
7/8/2026
概览健康基准与价格8测试记录40替代服务商嵌入
延迟
2.23 s
创建时间
8/13/2025

API 地址

  • 接口 1
    router.huggingface.co
  • 接口 2
    huggingface.co
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

关于 Hugging Face

Hugging Face is a collaboration platform for machine learning, hosting over 1 million models, 250,000 datasets, and 400,000 applications. It supports various modalities including text, image, video, audio, and 3D. Key offerings include the Hugging Face Hub for public hosting, Inference Providers API for accessing 45,000+ models from leading AI providers, and Compute solutions like Inference Endpoints and Spaces with GPU support. Enterprise plans start at $20/user/month, and Compute pricing begins at $0.60/hour for GPU. Use cases include model discovery, application deployment, and team collaboration in AI development.

健康检查

0%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 8 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型输入 ($/M)输出 ($/M)速度延迟
Qwen
Qwen/Qwen3.5-9B
--109.0 t/s7.99 s
MetaAI
meta-llama/Llama-3.3-70B-Instruct
--416.2 t/s0.26 s
MoonshotAI
moonshotai/Kimi-K2-Instruct:novita
--48.8 t/s1.21 s
Qwen
Qwen/Qwen3-Coder-480B-A35B-Instruct:novita
--63.6 t/s1.06 s
OpenAI
openai/gpt-oss-120b:novita
--240.3 t/s1.26 s
OpenAI
openai/gpt-oss-20b:novita
--155.7 t/s3.56 s
ChatGLM
zai-org/GLM-4.5:novita
--35.4 t/s1.39 s
Qwen
Qwen/Qwen3-235B-A22B:novita
--34.1 t/s1.12 s

当前显示 8 / 8 个模型行

最近测试记录

时间模型速度延迟
Apr 1, 06:16 AM
QwenQwen/Qwen3.5-9B
108.96 tok/s
7.99s
Jan 14, 02:25 AM
MetaAImeta-llama/Llama-3.3-70B-Instruct
416.19 tok/s
0.26s
Aug 13, 03:29 PM
MoonshotAImoonshotai/Kimi-K2-Instruct:novita
48.81 tok/s
1.21s
Aug 13, 03:26 PM
QwenQwen/Qwen3-Coder-480B-A35B-Instruct:novita
63.59 tok/s
1.06s
Aug 13, 02:45 PM
OpenAIopenai/gpt-oss-20b:novita
155.67 tok/s
3.56s
Aug 13, 02:41 PM
OpenAIopenai/gpt-oss-120b:novita
240.32 tok/s
1.26s
Aug 13, 02:35 PM
ChatGLMzai-org/GLM-4.5:novita
35.36 tok/s
1.39s
Aug 13, 03:46 AM
QwenQwen/Qwen3-235B-A22B:novita
34.12 tok/s
1.12s

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。
推理云

数据更新于 2026年7月8日 15:11·排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

相似 API 替代服务商对比

用 103 个 LMSpeed 信号,把 Hugging Face 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
Hugging Face

router-huggingface-co

Hugging Face Router provides intelligent model routing across Inference Providers, offering OpenAI-compatible API access to open-source models.

当前服务商基线70N/A138 tok/s0%
Fireworks AI

api-fireworks-ai

Fireworks AI provides a cloud platform for running and fine-tuning open-source AI models with optimized inference for production applications.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
110N/A139 tok/s92.2%

itokens

iTokens is an OpenAI-compatible AI API gateway with usage-based access to models from DeepSeek, GLM, Kimi, Qwen, MiniMax, KwaiKAT, and other developers. It publishes per-model token pricing and offers promotional credits to new users.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
100$1.36/M149 tok/s98.6%

api-kriora-com

Provides OpenAI-compatible APIs and managed GPU instances for deploying and scaling open-source AI models.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
90N/A565 tok/s99.7%

jembatanai

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
80N/A177 tok/s98.9%

openrouter

A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google.

  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
2650N/A85 tok/s99.9%

siliconflow

Provides cost-effective generative AI cloud services based on open-source models for text, image, video, and audio generation.

  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
620N/A56 tok/s56.4%
iTokens
Kriora
JembatanAI
OpenRouter
SiliconFlow