SpaceXAI
·Released on 2026年7月8日

Grok 4.5 API 基准测试 价格和服务商数据

选择与 Grok 4.5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Grok 4.5 页面汇总基准测试、API 价格和服务商数据,覆盖 233 家服务商,价格从 $0.0030/request 起。Grok 4.5 免费 API 额度来自 6 家服务商。页面同时展示实测速度和首字延迟。

Grok 4.5 is SpaceXAI's smartest model with frontier performance on coding, knowledge work, and STEM.

质量
#26of 100
67.0
LMSpeed 评分
速度
#56of 74
64char/s
10.99 s
成本
#139of 180
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
4 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体61.8代码59.5综合推理54.4知识57.8数学-多语言-多模态-指令遵循-
#1智能体61.8估算2/4 实测维度
80% 区间: 50.673.1
planning仅先验
tool use仅先验
environment execution63.9
gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability59.7
harvey_lab · aa_harvey_lab
#2代码59.5正式评分全站排名 #74/4 实测维度
80% 区间: 52.666.4
code generation61.7
scicode · scicode
repository engineering60.8
swe_pro · swe_pro
debugging testing57.1
swe_multilingual · benchlm_coding_swe_multilingual
tooling quality58.6
terminalbench · benchlm_coding_terminal_bench2
#3知识57.8暂定评分1/4 实测维度
80% 区间: 43.871.8
broad knowledge57.8
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#4综合推理54.4正式评分全站排名 #213/4 实测维度
80% 区间: 45.663.1
abstract logic45.6
arc_agi · arc_agi2
scientific causal62.8
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification54.7
lcr · lcr
暂无数据:数学多语言多模态指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
500Ktokens
600 pages of text
8K128K1M4M
500K

能力

Technical Details

输入
输出
发布日期
Jul 2026
官方文档
Tokenizer
Grok
架构
text+image+file->text
内容审核
支持参数
include_reasoninglogprobsmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月23日

综合

18 个指标

Overall score67.0#26 / 100DeepSWE53.0#13 / 16
Overall score
站内排名#26
分数67.0
更新时间2026年8月20日
置信度2
DeepSWE
站内排名#13
分数53.0
更新时间2026年8月20日
置信度2
Factuality hallucination rate
站内排名#4
分数1.0
更新时间2026年8月20日
置信度2
CVE-Bench
站内排名#2
分数35.2
更新时间2026年8月20日
置信度2
SecureCodeReview
站内排名#4
分数49.4
更新时间2026年8月20日
置信度2
HackerBench harmful compliance
站内排名#5
分数7.8
更新时间2026年8月20日
置信度2
VCT
站内排名#2
分数65.5
更新时间2026年8月20日
置信度2
WMDP Bio
站内排名#1
分数90.9
更新时间2026年8月20日
置信度2
WMDP Chem
站内排名#1
分数87.3
更新时间2026年8月20日
置信度2
LAB-Bench practical MCQ
站内排名#2
分数71.1
更新时间2026年8月20日
置信度2
ProtocolQA Open-Ended
站内排名#1
分数87.0
更新时间2026年8月20日
置信度2
Standard jailbreak compliance
站内排名#1
分数0.7
更新时间2026年8月20日
置信度2
General refusal compliance
站内排名#1
分数1.1
更新时间2026年8月20日
置信度2
Bio refusal accuracy
站内排名#2
分数97.9
更新时间2026年8月20日
置信度2
Chem refusal accuracy
站内排名#2
分数96.7
更新时间2026年8月20日
置信度2
Self-harm compliance
站内排名#2
分数0.5
更新时间2026年8月20日
置信度2
MASK-Rectified dishonesty
站内排名#2
分数0.7
更新时间2026年8月20日
置信度2
Sycophancy
站内排名#2
分数0.0
更新时间2026年8月20日
置信度2

速度与延迟

2 个指标

输出速度56.8 tok/s#56 / 74首字延迟11.57 s#65 / 74
输出速度
Output speed
站内排名#56
分数56.8 tok/s
更新时间2026年8月23日
置信度4
首字延迟
Time to first token
站内排名#65
分数11.57 s
更新时间2026年8月23日
置信度4

价格

2 个指标

输入价格$2.00/M#139 / 180输出价格$6.00/M#124 / 180
输入价格
Input price
站内排名#139
分数$2.00/M
更新时间2026年8月23日
置信度4
输出价格
Output price
站内排名#124
分数$6.00/M
更新时间2026年8月23日
置信度4

智能体

V3.0

8 个指标 · 估算

分数61.880% 区间50.6–73.12/4 实测维度Agentic score84.3#13 / 69Terminal-Bench 2.083.3#6 / 53
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行63.9
2 个基准族 · 2 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z 1.04 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 1.53 · q 1.00
恢复与完成可靠性59.7
1 个基准族 · 1 个指标
harvey_lab · aa_harvey_lab · z 0.70 · q 1.00
Agentic score
站内排名#13
分数84.3
更新时间2026年8月20日
置信度2
Terminal-Bench 2.0V3 计分证据
站内排名#6
分数83.3
更新时间2026年8月20日
置信度2
AA Agentic Index
站内排名#12
分数48.9
更新时间2026年8月20日
置信度2
GDPval-AA
站内排名#15
分数51.3
更新时间2026年8月20日
置信度2
GDPval-AAV3 计分证据
站内排名#13
分数1526.0
更新时间2026年8月20日
置信度2
AA AutomationBench
站内排名#3
分数51.4
更新时间2026年8月20日
置信度2
AA Harvey LABV3 计分证据
站内排名#4
分数92.4
更新时间2026年8月20日
置信度2
Terminal-Bench 3.0
站内排名#7
分数15.7
更新时间2026年8月20日
置信度2

代码

V3.0

17 个指标 · 正式评分

分数59.5#780% 区间52.6–66.44/4 实测维度SciCode54.1%#13 / 204Coding score60.1#28 / 81
维度与证据
代码生成61.7
1 个基准族 · 1 个指标
scicode · scicode · z 1.41 · q 1.00
仓库工程60.8
1 个基准族 · 1 个指标
swe_pro · swe_pro · z 1.49 · q 1.00
调试与测试57.1
1 个基准族 · 1 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z 0.71 · q 1.00
工具化开发与质量58.6
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 1.15 · q 1.00
SciCodeV3 计分证据
站内排名#13
分数54.1%
更新时间2026年8月23日
置信度4
Coding score
站内排名#28
分数60.1
更新时间2026年8月20日
置信度2
SWE-bench ProV3 计分证据
站内排名#5
分数64.7
更新时间2026年8月20日
置信度2
SWE MultilingualV3 计分证据
站内排名#6
分数78.0
更新时间2026年8月20日
置信度2
Terminal-Bench 2.0V3 计分证据
站内排名#5
分数83.3
更新时间2026年8月20日
置信度2
CursorBench v3.2
站内排名#5
分数66.7
更新时间2026年8月20日
置信度2
AA Coding Index
站内排名#11
分数72.5
更新时间2026年8月20日
置信度2
AA-SciCodeV3 计分证据
站内排名#14
分数54.1
更新时间2026年8月20日
置信度2
VulcanBench v3
站内排名#1
分数91.3
更新时间2026年8月20日
置信度2
APEX-SWE
站内排名#3
分数53.6
更新时间2026年8月20日
置信度2
EEBench
站内排名#4
分数50.9
更新时间2026年8月20日
置信度2
3DCodeBench
站内排名#2
分数49.8
更新时间2026年8月20日
置信度2
CADGenBench Generation
站内排名#4
分数33.2
更新时间2026年8月20日
置信度2
CADBench
站内排名#3
分数83.7
更新时间2026年8月20日
置信度2
SpaceXAI MTS Eval
站内排名#2
分数57.1
更新时间2026年8月20日
置信度2
InferenceEval
站内排名#3
分数41.3
更新时间2026年8月20日
置信度2
KernelBench Internal
站内排名#5
分数58.4
更新时间2026年8月20日
置信度2

综合推理

V3.0

7 个指标 · 正式评分

分数54.4#2180% 区间45.6–63.13/4 实测维度GPQA93.1%#9 / 211HLE42.7%#16 / 208
维度与证据
抽象逻辑45.6
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z -0.76 · q 1.00
科学与因果推理62.8
3 个基准族 · 3 个指标
critpt · critpt · z 0.76 · q 1.00
gpqa · gpqa · z 1.31 · q 1.00
hle · hle · z 1.00 · q 1.00
多步约束仅先验
证据整合与验证54.7
1 个基准族 · 1 个指标
lcr · lcr · z 0.27 · q 1.00
GPQAV3 计分证据
站内排名#9
分数93.1%
更新时间2026年8月23日
置信度4
HLEV3 计分证据
站内排名#16
分数42.7%
更新时间2026年8月23日
置信度4
AA-LCRV3 计分证据
站内排名#35
分数74.0
更新时间2026年8月20日
置信度2
CritPtV3 计分证据
站内排名#21
分数15.4
更新时间2026年8月20日
置信度2
Reasoning score
站内排名#26
分数50.5
更新时间2026年8月20日
置信度2
ARC-AGI-2V3 计分证据
站内排名#14
分数52.6
更新时间2026年8月20日
置信度2
ARC-AGI-3
站内排名#7
分数0.3
更新时间2026年8月20日
置信度2

知识

V3.0

7 个指标 · 暂定评分

分数57.880% 区间43.8–71.81/4 实测维度Artificial Analysis Intelligence Index55.8#11 / 111AA-GPQA Diamond93.1#8 / 108
维度与证据
广泛知识57.8
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.99 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.14 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#11
分数55.8
更新时间2026年8月20日
置信度2
AA-GPQA Diamond
站内排名#8
分数93.1
更新时间2026年8月20日
置信度2
AA-HLE
站内排名#15
分数42.7
更新时间2026年8月20日
置信度2
AA-Omniscience IndexV3 计分证据
站内排名#10
分数25.3
更新时间2026年8月20日
置信度2
AA-Omniscience Accuracy
站内排名#11
分数51.6
更新时间2026年8月20日
置信度2
AA-Omniscience Hallucination Rate
站内排名#68
分数54.1
更新时间2026年8月20日
置信度2
Knowledge scoreV3 计分证据
站内排名#30
分数71.1
更新时间2026年8月20日
置信度2

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

2 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度AA-MMMU-Pro80.4#11 / 65Design Arena Website1299.0#13 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
AA-MMMU-Pro
站内排名#11
分数80.4
更新时间2026年8月20日
置信度2
Design Arena Website
站内排名#13
分数1299.0
更新时间2026年8月20日
置信度2

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

4 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
xAI
xai/zdr
$2/M$6/M100.0%undefined tokens / —
xAI
xai/zdr/priority
$4/M$12/M100.0%undefined tokens / —
xAI
xai
$2/M$6/M99.9%undefined tokens / —
xAI
xai/priority
$4/M$12/M99.9%undefined tokens / —

价格对比

对比 Grok 4.5 在 227 家服务商的 API 价格。价格从 $0.0030/request 到 $547.50/M,其中 Crond 提供最低价 $0.0030/request。 6 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
L2
38%
grok-4.5
default
$75.00/M
$75.00/M
57.8 t/s+2%
15.17 s
L1
100%
grok-4.5
grok-sale
-99%$0.029/M
Cache read$0.0071/M
-99%$0.086/M
L1
100%
grok-4.5
default
-93%$0.137/M
Cache read$0.034/M
-93%$0.411/M
L1
100%
grok-4.5
Grok
-92%$0.150/M
Cache read$0.037/M
-92%$0.450/M
L1
100%
grok-4.5
discount-grok
-95%$0.100/M
Cache read$0.025/M
-95%$0.300/M
L1
100%
grok-4.5
default
-86%$0.274/M
Cache read$0.068/M
-86%$0.822/M
L1
100%
grok-4-5
grok
-75%$0.500/M
Cache read$0.125/M
-75%$1.50/M
L1
100%
grok-4.5
grok
-75%$0.500/M
Cache read$0.125/M
-75%$1.50/M
L1
100%
grok-4.5
xAI
-66%$0.685/M
Cache read$0.171/M
-66%$2.05/M
L1
100%
grok-4.5
xai
-64%$0.719/M
-88%$0.719/M
L1
100%
grok-4.5
grok_official_Mzg=
-48%$1.04/M
-48%$3.12/M
L1
100%
grok-4.5
default
$2.00/M
Cache read$0.500/M
$6.00/M
L1
100%
grok-4.5
default
$2.00/M
Cache read$0.300/M
-50%$3.00/M
兔子API
免费
L1
100%
grok-4.5
default
免费
免费
L1
100%
grok-4.5
grok-1
-93%$0.137/M
Cache read$0.034/M
-93%$0.411/M
L1
100%
grok-4.5
grok
-90%$0.200/M
Cache read$0.050/M
-90%$0.600/M
L1
100%
grok-4.5
bhkld
$1.37/request
-
L1
100%
grok-4.5
default
-23%$1.53/M
-49%$3.07/M
L1
100%
grok-4.5
default
$75.00/M
$75.00/M
L1
100%
按次-grok-4.5
按次计费
$0.020/request
-
当前显示 20 个模型 ID,共 115 个。

替代方案与相似模型

常见问题

Grok 4.5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Grok 4.5 的基准测试、API 价格、输出速度、首字延迟和 233 家服务商数据。
Grok 4.5 API 价格是多少?
Grok 4.5233 家服务商有价格记录,价格从 $0.0030/request $547.50/M。最低价由 Crond 提供。
Grok 4.5 API 价格表包含什么?
Grok 4.5 API 价格表会对比 233 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Grok 4.5 API 价格最低?
Crond 当前提供 Grok 4.5 的最低收录价格:$0.0030/request,共对比 233 家服务商。
可以同时对比 Grok 4.5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Grok 4.5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Grok 4.5 的 API 免费吗?
是的,Grok 4.5 免费 API 可通过 LMSpeed 上的 6 家服务商使用,包括兔子API, 兔子API, Dext API, 我不是AI神, 我不是AI神。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Grok 4.5 免费 API?
LMSpeed 当前收录了 6 家 Grok 4.5 免费 API 服务商,包括兔子API, 兔子API, Dext API, 我不是AI神, 我不是AI神。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Grok-4.5-HighX-AI/Grok-4.5-Free[lq]q|CS/grok-4.5[lq]q|HP/grok-4.5[lq]q|XJ/grok-4.5

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档