integrate.api.nvidia.com

NVIDIA NIM 通过 NVIDIA 云基础设施提供优化的 AI 模型推理 API,支持大语言模型、视觉和向量模型。

模型
168 个
最低
--
速度
82 tok/s
更新
7/8/2026
延迟
0.00 s
创建时间
8/13/2025

API 地址

  • 接口 1
    integrate.api.nvidia.com
认领该站点

完成站点认证,解锁以下权益:

  • 编辑服务商名称、正文和链接
  • 获得优先流量扶持和曝光推荐
  • 展示官方认证徽章,提升用户信任

排行榜排名

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。

关于 NVIDIA NIM

NVIDIA NIM(NVIDIA Inference Microservices)是 NVIDIA 推出的 AI 模型推理服务,提供经过优化的大语言模型、视觉模型和向量模型的 API 访问。支持 Meta Llama、Mistral 等主流开源模型,利用 NVIDIA GPU 加速实现高性能推理。

健康检查

100%近期可用性
历史记录 (72 条)
过去现在

API 基准测试与价格

按 167 个模型行对比最新 audit、最新测速、吞吐、延迟与按 token 计费价格。

模型
速度
延迟
nvidia/nemotron-parse-2.0
818.6 t/s0.23 s
161.8 t/s15.62 s
meta/muse-glimmer-30b
59.1 t/s64.35 s
455.3 t/s39.37 s
nvidia/riva-translate-4b-instruct-v2
98.2 t/s0.26 s
nvidia/ising-calibration-1.5-31b
61.3 t/s0.43 s
qwen/qwen3-next-80b-a3b-instruct
--
nvidia/nemotron-3-embed-1b
--
21.3 t/s12.90 s
thinkingmachines/inkling
--
99.2 t/s0.25 s
43.4 t/s2.41 s
google/diffusiongemma-26b-a4b-it
502.8 t/s3.18 s
nvidia/nemotron-3-ultra-550b-a55b
65.2 t/s2.73 s
nvidia/nemotron-3.5-content-safety
--
15.8 t/s1.95 s
194.4 t/s25.66 s
moonshotai/kimi-k2-instruct-0905
--
46.8 t/s10.40 s
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
199.5 t/s1.21 s
adept/fuyu-8b
--
aisingapore/sea-lion-7b-instruct
--
baai/bge-m3
--
bigcode/starcoder2-15b
--
bytedance/seed-oss-36b-instruct
--

当前显示 25 / 167 个模型行

免费资源

社区分享的与 NVIDIA NIM 相关的 API Key 和兑换码。

免费 API Key

1
查看全部
API Key / 状态API URL模型发布人/日期

nvapi-***yAtj

不可用
https://api.nvidia.com/v1模型检测中Cola_Rs· 2026年7月23日

最近测试记录

时间模型速度延迟
Sep 12, 07:32 AM
nvidia/nemotron-3-ultra-550b-a55b
46.69 tok/s
1.46s
Sep 12, 03:39 AM
google/diffusiongemma-26b-a4b-it
299.31 tok/s
2.72s
Sep 12, 03:39 AM
meta/llama-3.2-11b-vision-instruct
37.18 tok/s
1.11s
Sep 12, 03:39 AM
meta/muse-glimmer-30b
14.17 tok/s
46.66s
Sep 12, 03:39 AM
moonshotai/kimi-k3
40.78 tok/s
35.47s
Sep 12, 03:39 AM
nvidia/ising-calibration-1.5-31b
59.92 tok/s
0.55s
Sep 12, 03:39 AM
nvidia/nemotron-3-super-120b-a12b
124.97 tok/s
11.45s
Sep 12, 03:39 AM
nvidia/nemotron-parse-2.0
818.64 tok/s
0.23s
Sep 12, 03:39 AM
openai/gpt-oss-20b
76.07 tok/s
3.44s
Sep 12, 03:39 AM
poolside/laguna-xs-2.1
72.61 tok/s
0.24s

相似 API 替代服务商对比

用 351 个 LMSpeed 信号,把 NVIDIA NIM 的 6 个相近 API 替代服务商放在一起比较:共享模型覆盖、价格、实测速度、可用性和免费模型。

服务商对比理由模型数免费项均价速度30 天可用性
NVIDIA NIM

nvidia-nim

NVIDIA NIM provides optimized AI model inference APIs for LLMs, vision, and embedding models through NVIDIA cloud infrastructure.

当前服务商基线1680N/A82 tok/s9970%
OpenRouter

openrouter

A unified API interface providing access to over 300 models from 60+ providers, including OpenAI, Anthropic, and Google.

  • 实测速度更快
  • 30 天可用性更高
  • 模型覆盖更广
  • 同分类服务商
6140N/A85 tok/s9990%
S3AI API

s3ai-api

  • 免费模型更多
  • 模型覆盖更广
  • 同分类服务商
25145$0.000000103/M59 tok/s9580%
并行科技

llmapi-paratera-com

Provides high-performance computing (HPC) and AI infrastructure services, including GPU cloud servers, MaaS platforms, and industry-specific solutions.

  • 实测速度更快
  • 同分类服务商
970N/A195 tok/s0%
七牛云

qiniu-2

七牛云提供AI大模型推理服务,包括多种模型调用、智能问答助手、代码助手等企业级AI解决方案。

  • 实测速度更快
  • 同分类服务商
920N/A90 tok/s9970%
SophNet

www-sophnet-com

An AI development platform offering API access to models like DeepSeek and Qwen for tasks such as text generation and code creation.

  • 实测速度更快
  • 同分类服务商
720N/A122 tok/s9960%
Fireworks AI

api-fireworks-ai

Fireworks AI provides a cloud platform for running and fine-tuning open-source AI models with optimized inference for production applications.

  • 实测速度更快
  • 同分类服务商
360N/A139 tok/s5390%

注释

  • 健康检查: 统计范围:72 小时图表和近期可用率只衡量 API 连通性,每个柱形汇总一小时内的检查结果。 检查目标:LMSpeed 会优先尝试已配置的健康检查 URL 和 Provider 状态 URL,再尝试从已知 API Host 与近期测速 Base URL 推导出的 API 端点;只有官网地址本身明显是 API 地址时才会作为候选。 探测步骤:每个候选地址依次进行 DNS 解析、TCP 连接、HTTPS 的 TLS 握手,以及自动跟随重定向的 HTTP HEAD 请求;找到首个可达地址后停止尝试。 可达标准:所有必需的网络步骤都必须成功。除被归类为拦截的状态外,低于 500 的 HTTP 响应均视为可达;其中 401 表示需要鉴权,但也证明 API 端点已响应。 拦截结果:HTTP 403、429、521、525、530,以及识别出的 WAF 或 Cloudflare 挑战会标记为“被拦截”,不计入可用率,因为 LMSpeed 无法据此判断 API 本身是否宕机。 模型可用性:配置专用测试 Key 后,LMSpeed 会向推导出的 /models 端点发送带鉴权的 GET 请求,并将返回的模型 ID 与该 Provider 收录的模型进行比对。逐模型结果显示在“模型与价格”中,不计入 Provider 连通性百分比。 超时限制:TCP 连接、TLS 握手、HTTP 连通性请求和模型请求分别使用 20 秒超时;尝试多个候选地址时,整轮检查可能超过 20 秒。 检查频率:后台 Worker 默认每 5 分钟检查一次所有 Provider;72 小时图表会将这些采样汇总为小时柱形,运营方也可以调整调度。 限制说明:自动抽样结果不构成 SLA,也不能保证账户额度、所有模型、所有地区或实际补全请求始终成功;作出运维决策前请同时查看 Provider 官方状态页。
  • Domain Rating 数据来自 Ahrefs。它是基于外链估算的 0–100 域名强度信号,不代表 API 速度或可用性。
  • 页面上的公告和 FAQ 来自该服务商的 NewAPI 状态快照(如果可用)。LMSpeed 会保存服务商状态源中的原始内容和可选英文翻译,并在页面上展示对应语言字段。