NVIDIA
·Released on 2026年6月4日

Nemotron 3 Ultra API 基准测试 价格和服务商数据

选择与 Nemotron 3 Ultra 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Nemotron 3 Ultra 页面汇总基准测试、API 价格和服务商数据,覆盖 28 家服务商,价格从 $0.0010/request 起。Nemotron 3 Ultra 免费 API 额度来自 1 家服务商。

NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts ar...

成本
#93of 180
$0.0010/ 1M · 8:1 in:out
$0.0002 in · $0.0008 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
2 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体-代码52.3综合推理56.8知识-数学-多语言-多模态-指令遵循-
#1综合推理56.8暂定评分1/4 实测维度
80% 区间: 42.970.7
abstract logic仅先验
scientific causal56.8
gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification仅先验
#2代码52.3暂定评分1/4 实测维度
80% 区间: 36.368.3
code generation52.3
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识数学多语言多模态指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
512.3Ktokens
614.7 pages of text
OUTPUT
16.4Ktokens
8K128K1M4M
512.3K

能力

Technical Details

输入
输出
总参数量
550B
激活参数量
55B
发布日期
Jun 2026
Tokenizer
Other
架构
text->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

排名

擅长

详细分数

更新时间: 2026年8月22日

速度与延迟

2 个指标

输出速度120.3 tok/s#30 / 74首字延迟1.78 s#51 / 74
输出速度
Output speed
站内排名#30
分数120.3 tok/s
更新时间2026年8月22日
置信度4
首字延迟
Time to first token
站内排名#51
分数1.78 s
更新时间2026年8月22日
置信度4

价格

2 个指标

输入价格$0.600/M#93 / 180输出价格$2.75/M#95 / 180
输入价格
Input price
站内排名#93
分数$0.600/M
更新时间2026年8月22日
置信度4
输出价格
Output price
站内排名#95
分数$2.75/M
更新时间2026年8月22日
置信度4

智能体

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验

代码

V3.0

1 个指标 · 暂定评分

分数52.380% 区间36.3–68.31/4 实测维度SciCode39.9%#85 / 204
维度与证据
代码生成52.3
1 个基准族 · 1 个指标
scicode · scicode · z 0.16 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#85
分数39.9%
更新时间2026年8月22日
置信度4

综合推理

V3.0

2 个指标 · 暂定评分

分数56.880% 区间42.9–70.71/4 实测维度GPQA86.7%#51 / 211HLE28.4%#56 / 208
维度与证据
抽象逻辑仅先验
科学与因果推理56.8
2 个基准族 · 2 个指标
gpqa · gpqa · z 0.63 · q 1.00
hle · hle · z 0.59 · q 1.00
多步约束仅先验
证据整合与验证仅先验
GPQAV3 计分证据
站内排名#51
分数86.7%
更新时间2026年8月22日
置信度4
HLEV3 计分证据
站内排名#56
分数28.4%
更新时间2026年8月22日
置信度4

知识

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

4 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
BaseTen
baseten/fp4
$0.600/M$2.40/M99.5%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp4
$0.500/M$2.20/M97.8%undefined tokens / undefined tokens
Together
together
$0.600/M$3.60/M97.5%undefined tokens / —
Venice
venice/fp8
$0.625/M$3.13/M93.7%undefined tokens / undefined tokens

价格对比

对比 Nemotron 3 Ultra 在 27 家服务商的 API 价格。价格从 $0.0010/request 到 $4995.00/M,其中 CM-API 公益站 提供最低价 $0.0010/request。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
nvidia/nemotron-3-ultra-550b-a55b:free
free
$0.0010/request
-
L1
100%
nvidia/nemotron-3-ultra-550b-a55b
国产模型
$0.010/request
-
L1
99%
L2
88%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M
L1
100%
nvidia/nemotron-3-ultra-550b-a55b
default
$375.00/M
$375.00/M
L1
100%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M
L1
99%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M
L1
95%
nvidia/nemotron-3-ultra-550b-a55b
0倍倍率分组
-98%$0.014/M
-99%$0.041/M
L1
47%
nvidia/nemotron-3-ultra-550b-a55b
default
$4995.00/M
Cache read$1498.50/M
$24975.00/M
L1
3%
nemotron-3-ultra-550b-a55b
小叶币
$0.050/request
-
L1
43%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M
L1
100%
nvidia/nemotron-3-ultra-550b-a55b:free
default
$0.010/request
-
L1
91%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M
Dext API
免费
L1
12%
nemotron-3-ultra-550b-a55b
公益
免费
免费
L1
0%
nvidia/nemotron-3-ultra-550b-a55b:free
懒人
-46%$0.321/M
-88%$0.321/M
L1
0%
nvidia/nemotron-3-ultra-550b-a55b
Free
-17%$0.500/M
Cache read$0.100/M
-20%$2.20/M
L1
0%
nvidia/nemotron-3-ultra-550b-a55b
default
$75.00/M
$75.00/M

替代方案与相似模型

常见问题

Nemotron 3 Ultra 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Nemotron 3 Ultra 的基准测试、API 价格、输出速度、首字延迟和 28 家服务商数据。
Nemotron 3 Ultra API 价格是多少?
Nemotron 3 Ultra28 家服务商有价格记录,价格从 $0.0010/request $4995.00/M。最低价由 CM-API 公益站 提供。
Nemotron 3 Ultra API 价格表包含什么?
Nemotron 3 Ultra API 价格表会对比 28 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Nemotron 3 Ultra API 价格最低?
CM-API 公益站 当前提供 Nemotron 3 Ultra 的最低收录价格:$0.0010/request,共对比 28 家服务商。
Nemotron 3 Ultra 的 API 免费吗?
是的,Nemotron 3 Ultra 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Dext API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Nemotron 3 Ultra 免费 API?
LMSpeed 当前收录了 1 家 Nemotron 3 Ultra 免费 API 服务商,包括Dext API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

nemotron-3-ultra-550b-a55bnvidia/nemotron-3-ultra-550b-a55bnvidia/nemotron-3-ultra-550b-a55b:free

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。Artificial Analysis标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档