SpaceXAI
·Released on 2026年3月31日

Grok 4.20 API 基准测试 价格和服务商数据

选择与 Grok 4.20 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Grok 4.20 页面汇总基准测试、API 价格和服务商数据,覆盖 88 家服务商,价格从 $0.0050/request 起。Grok 4.20 免费 API 额度来自 2 家服务商。页面同时展示实测速度和首字延迟。

Grok 4.20是语言模型,专为通用对话与文本生成任务优化。

质量
#82of 100
45.0
LMSpeed 评分
速度
75char/s
4.82 s
成本
#120of 181
$0.0050/ 1M · 8:1 in:out
$0.0008 in · $0.0042 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
5 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体43.1代码47.2综合推理52.3知识44.1数学-多语言-多模态40.2指令遵循-
#1综合推理52.3估算2/4 实测维度
80% 区间: 41.063.5
abstract logic45.8
arc_agi · arc_agi2
scientific causal58.7
gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification仅先验
#2代码47.2正式评分全站排名 #323/4 实测维度
80% 区间: 38.655.8
code generation54.3
livecodebench · live_code_bench_pro / scicode · scicode
repository engineering37.1
swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing50.2
swe_verified · swe_verified
tooling quality仅先验
#3知识44.1暂定评分1/4 实测维度
80% 区间: 29.059.3
broad knowledge仅先验
professional knowledge44.1
healthbench · health_bench_hard / medxpert · med_xpert_qa_text
factuality仅先验
retrieval open book仅先验
#4智能体43.1估算2/4 实测维度
80% 区间: 31.954.3
planning44.5
deep_planning · gert_labs
tool use仅先验
environment execution41.7
deep_search_qa · deep_search_qa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability仅先验
#5多模态40.2估算3/4 实测维度
80% 区间: 31.349.1
perception ocr44.8
simplevqa · simple_vqa
document spatial34.8
charxiv · charxiv
visual reasoning41.1
erqa · erqa / medxpert · med_xpert_qa_mm / mmmu_pro · mmmu_pro
video action仅先验
暂无数据:数学多语言指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
2Mtokens
2.4K pages of text
OUTPUT
1.8Mtokens
8K128K1M4M
2M

能力

Technical Details

输入
输出
发布日期
Mar 2026
知识截止
2025-09-01
官方文档
Tokenizer
Grok
架构
text+image+file->text
内容审核
支持参数
include_reasoninglogprobsmax_tokensreasoningresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score45.0#82 / 100
Overall score
站内排名#82
分数45.0
更新时间2026年8月20日
置信度2

价格

2 个指标

输入价格$1.25/M#120 / 181输出价格$2.50/M#87 / 181
输入价格
Input price
站内排名#120
分数$1.25/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#87
分数$2.50/M
更新时间2026年9月1日
置信度4

智能体

V3.0

4 个指标 · 估算

分数43.180% 区间31.9–54.32/4 实测维度Agentic score30.4#60 / 69Terminal-Bench 2.047.1#47 / 53
维度与证据
规划拆解44.5
1 个基准族 · 1 个指标
deep_planning · gert_labs · z -0.72 · q 1.00
工具调用仅先验
环境与长程执行41.7
2 个基准族 · 2 个指标
deep_search_qa · deep_search_qa · z -0.85 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -1.00 · q 1.00
恢复与完成可靠性仅先验
Agentic score
站内排名#60
分数30.4
更新时间2026年8月20日
置信度2
Terminal-Bench 2.0V3 计分证据
站内排名#47
分数47.1
更新时间2026年8月20日
置信度2
DeepSearchQAV3 计分证据
站内排名#13
分数62.8
更新时间2026年8月20日
置信度2
Gert LabsV3 计分证据
站内排名#41
分数38.4
更新时间2026年8月20日
置信度2

代码

V3.0

6 个指标 · 正式评分

分数47.2#3280% 区间38.6–55.83/4 实测维度SciCode45.6%#46 / 206Coding score48.1#59 / 81
维度与证据
代码生成54.3
2 个基准族 · 2 个指标
livecodebench · live_code_bench_pro · z -0.54 · q 0.50
scicode · scicode · z 0.71 · q 1.00
仓库工程37.1
2 个基准族 · 2 个指标
swe_pro · swe_pro · z -0.91 · q 1.00
vibecode · vibe_code_bench · z -1.62 · q 1.00
调试与测试50.2
1 个基准族 · 1 个指标
swe_verified · swe_verified · z -0.02 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#46
分数45.6%
更新时间2026年9月1日
置信度4
Coding score
站内排名#59
分数48.1
更新时间2026年8月20日
置信度2
LiveCodeBench ProV3 计分证据
站内排名#3
分数74.2
更新时间2026年8月20日
置信度2
SWE-bench VerifiedV3 计分证据
站内排名#28
分数76.7
更新时间2026年8月20日
置信度2
SWE-bench ProV3 计分证据
站内排名#43
分数51.8
更新时间2026年8月20日
置信度2
Vibe Code BenchV3 计分证据
站内排名#30
分数4.1
更新时间2026年8月20日
置信度2

综合推理

V3.0

5 个指标 · 估算

分数52.380% 区间41.0–63.52/4 实测维度GPQA91.1%#22 / 213HLE34.5%#40 / 210
维度与证据
抽象逻辑45.8
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z -0.74 · q 1.00
科学与因果推理58.7
2 个基准族 · 3 个指标
gpqa · gpqa · z 1.07 · q 1.00
hle · hle · z 0.79 · q 1.00
hle · hle_no_tools · z -1.11 · q 1.00
多步约束仅先验
证据整合与验证仅先验
GPQAV3 计分证据
站内排名#22
分数91.1%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#40
分数34.5%
更新时间2026年9月1日
置信度4
Reasoning score
站内排名#23
分数51.2
更新时间2026年8月20日
置信度2
ARC-AGI-2V3 计分证据
站内排名#12
分数53.3
更新时间2026年8月20日
置信度2
ARC-AGI-3
站内排名#11
分数0.1
更新时间2026年8月20日
置信度2

知识

V3.0

4 个指标 · 暂定评分

分数44.180% 区间29.0–59.31/4 实测维度GPQA-D88.5#21 / 31HLE w/o tools31.6#16 / 21
维度与证据
广泛知识仅先验
专业知识44.1
2 个基准族 · 2 个指标
healthbench · health_bench_hard · z -1.28 · q 0.88
medxpert · med_xpert_qa_text · z -0.68 · q 0.50
事实性仅先验
检索与开放资料运用仅先验
GPQA-D
站内排名#21
分数88.5
更新时间2026年8月20日
置信度2
HLE w/o tools
站内排名#16
分数31.6
更新时间2026年8月20日
置信度2
HealthBench HardV3 计分证据
站内排名#6
分数20.3
更新时间2026年8月20日
置信度2
MedXpertQA (Text)V3 计分证据
站内排名#4
分数50.2
更新时间2026年8月20日
置信度2

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

7 个指标 · 估算

分数40.280% 区间31.3–49.13/4 实测维度Multimodal Grounded score35.9#41 / 44MMMU-Pro75.2#25 / 31
维度与证据
感知与 OCR44.8
1 个基准族 · 1 个指标
simplevqa · simple_vqa · z -0.68 · q 1.00
文档与空间理解34.8
1 个基准族 · 1 个指标
charxiv · charxiv · z -1.90 · q 1.00
视觉推理41.1
3 个基准族 · 3 个指标
erqa · erqa · z -1.60 · q 1.00
medxpert · med_xpert_qa_mm · z -0.83 · q 0.75
mmmu_pro · mmmu_pro · z -0.76 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#41
分数35.9
更新时间2026年8月20日
置信度2
MMMU-ProV3 计分证据
站内排名#25
分数75.2
更新时间2026年8月20日
置信度2
CharXivV3 计分证据
站内排名#28
分数60.9
更新时间2026年8月20日
置信度2
ERQAV3 计分证据
站内排名#7
分数54.1
更新时间2026年8月20日
置信度2
SimpleVQAV3 计分证据
站内排名#7
分数57.4
更新时间2026年8月20日
置信度2
MedXpertQA (MM)V3 计分证据
站内排名#5
分数65.8
更新时间2026年8月20日
置信度2
Design Arena Website
站内排名#37
分数1239.0
更新时间2026年8月20日
置信度2

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

4 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
xAI
xai/priority
$2.50/M$5/M100%undefined tokens / undefined tokens
xAI
xai/zdr/priority
$2.50/M$5/M100%undefined tokens / undefined tokens
xAI
xai
$1.25/M$2.50/M99.9%undefined tokens / undefined tokens
xAI
xai/zdr
$1.25/M$2.50/M99.9%undefined tokens / undefined tokens

价格对比

对比 Grok 4.20 在 86 家服务商的 API 价格。价格从 $0.0050/request 到 $75.00/M,其中 Kunkunout API 提供最低价 $0.0050/request。 2 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
98%
grok-4.20-fast
临时渠道
-98%$0.027/M
-98%$0.055/M
90.1 t/s
3.35 s
L1
98%
grok-4.20-0309
临时渠道
-98%$0.027/M
-95%$0.137/M
L1
100%
grok-4.20-fast
default
-20%$1.00/M
Cache read$0.010/M
-60%$1.00/M
L1
100%
L2
62%
grok-4.20-0309
default
$75.00/M
$75.00/M
L1
99%
grok-4.20-fast
other
-33%$0.833/M
Cache read$0.083/M
$2.50/M
L1
99%
grok-4.20-0309
other
-33%$0.833/M
Cache read$0.083/M
$2.50/M
L1
100%
grok-4.20-fast
default
免费
免费
L1
99%
grok-4.20-fast
按次计费
$0.020/request
-
L1
100%
[lq]q|YS/grok-4.20-fast
default
$6.00/request
-
L1
100%
grok-4.20-fast
default
$10.00/M
$10.00/M
L1
100%
grok-4.20-fast
Chat
-99%$0.014/M
-99%$0.034/M
L1
100%
grok-4.20-0309
Chat
-89%$0.137/M
-84%$0.411/M
L1
100%
grok-4.20-0309
default
-78%$0.274/M
$2.74/M
L1
100%
grok-4.20-fast
default
-78%$0.274/M
$2.74/M
L1
99%
grok-4.20-fast
default
-78%$0.274/M
-67%$0.822/M
L1
99%
grok-4.20-0309
default
-78%$0.274/M
-67%$0.822/M
L1
99%
grok-4.20-fast
default
-22%$0.979/M
Cache read$0.098/M
$2.94/M
L1
99%
grok-4.20-0309
default
-22%$0.979/M
Cache read$0.098/M
$2.94/M
L1
99%
grok-4.20-fast
grok
$0.0050/request
-
L1
100%
grok-4.20-beta
default
$0.010/request
-
当前显示 20 个模型 ID,共 47 个。

替代方案与相似模型

常见问题

Grok 4.20 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Grok 4.20 的基准测试、API 价格、输出速度、首字延迟和 88 家服务商数据。
Grok 4.20 API 价格是多少?
Grok 4.2088 家服务商有价格记录,价格从 $0.0050/request $75.00/M。最低价由 Kunkunout API 提供。
Grok 4.20 API 价格表包含什么?
Grok 4.20 API 价格表会对比 88 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Grok 4.20 API 价格最低?
Kunkunout API 当前提供 Grok 4.20 的最低收录价格:$0.0050/request,共对比 88 家服务商。
可以同时对比 Grok 4.20 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Grok 4.20 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Grok 4.20 的 API 免费吗?
是的,Grok 4.20 免费 API 可通过 LMSpeed 上的 2 家服务商使用,包括Moyanjdc API, Dext API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Grok 4.20 免费 API?
LMSpeed 当前收录了 2 家 Grok 4.20 免费 API 服务商,包括Moyanjdc API, Dext API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

[A-VIP]/grok-4.20-0309[lq]q|Rim/grok-4.20-beta[lq]q|XJ/grok-4.20-fast[lq]q|YS/grok-4.20-0309[lq]q|YS/grok-4.20-fast

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档