Meta
·Released on 2025年4月5日

Llama 4 Maverick API 基准测试 价格和服务商数据

选择与 Llama 4 Maverick 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Llama 4 Maverick 页面汇总基准测试、API 价格和服务商数据,覆盖 17 家服务商,价格从 $0.0038/M 起。Llama 4 Maverick 免费 API 额度来自 1 家服务商。

Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forw...

质量
#91of 100
43.0
LMSpeed 评分
成本
#49of 179
$0.0038/ 1M · 8:1 in:out
$0.0006 in · $0.0032 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体33代码45.4综合推理46.8知识41.1数学46.2多语言-多模态-指令遵循44.3
#1综合推理46.8正式评分全站排名 #523/4 实测维度
80% 区间: 38.155.5
abstract logic仅先验
scientific causal44.1
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints52.3
mmlu_pro · mmlu_pro
evidence verification44.1
lcr · lcr
#2数学46.2估算3/4 实测维度
80% 区间: 36.955.4
foundational math50.7
math_500 · math_500
competition math51.6
aime · aime
proof frontier36.1
frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#3代码45.4暂定评分1/4 实测维度
80% 区间: 31.559.4
code generation45.4
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
#4指令遵循44.3暂定评分1/4 实测维度
80% 区间: 28.360.3
constraint following仅先验
structured output仅先验
novel instruction generalization44.3
ifbench · aa_if_bench
long multiturn instruction仅先验
#5知识41.1暂定评分1/4 实测维度
80% 区间: 25.057.1
broad knowledge41.1
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#6智能体33估算2/4 实测维度
80% 区间: 21.244.8
planning仅先验
tool use37.2
tau · tau2_bench
environment execution28.8
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliability仅先验
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
16.4Ktokens
8K128K1M4M
1.0M

能力

Technical Details

输入
输出
总参数量
17B
发布日期
Apr 2025
知识截止
2024-08-31
Tokenizer
Llama4
架构
text+image->text
内容审核
支持参数
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月25日

综合

1 个指标

Overall score43.0#91 / 100
Overall score
站内排名#91
分数43.0
更新时间2026年8月20日
置信度1

速度与延迟

2 个指标

输出速度101.3 tok/s#38 / 74首字延迟0.58 s#12 / 74
输出速度
Output speed
站内排名#38
分数101.3 tok/s
更新时间2026年8月25日
置信度4
首字延迟
Time to first token
站内排名#12
分数0.58 s
更新时间2026年8月25日
置信度4

价格

2 个指标

输入价格$0.260/M#49 / 179输出价格$0.910/M#43 / 179
输入价格
Input price
站内排名#49
分数$0.260/M
更新时间2026年8月25日
置信度4
输出价格
Output price
站内排名#43
分数$0.910/M
更新时间2026年8月25日
置信度4

智能体

V3.0

3 个指标 · 估算

分数3380% 区间21.2–44.82/4 实测维度AA Agentic Index1.2#62 / 65Τ²-bench results17.8#79 / 82
维度与证据
规划拆解仅先验
工具调用37.2
1 个基准族 · 1 个指标
tau · tau2_bench · z -1.82 · q 1.00
环境与长程执行28.8
1 个基准族 · 1 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z -3.00 · q 1.00
恢复与完成可靠性仅先验
AA Agentic Index
站内排名#62
分数1.2
更新时间2026年8月20日
置信度1
Τ²-bench resultsV3 计分证据
站内排名#79
分数17.8
更新时间2026年8月20日
置信度1
GDPval-AAV3 计分证据
站内排名#66
分数3.0
更新时间2026年8月20日
置信度1

代码

V3.0

4 个指标 · 暂定评分

分数45.480% 区间31.5–59.41/4 实测维度LiveCodeBench39.7%#76 / 115SciCode33.1%#138 / 204
维度与证据
代码生成45.4
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.23 · q 1.00
scicode · scicode · z -0.48 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#76
分数39.7%
更新时间2026年8月25日
置信度4
SciCodeV3 计分证据
站内排名#138
分数33.1%
更新时间2026年8月25日
置信度4
AA Coding Index
站内排名#67
分数16.3
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#92
分数33.1
更新时间2026年8月20日
置信度1

综合推理

V3.0

4 个指标 · 正式评分

分数46.8#5280% 区间38.1–55.53/4 实测维度MMLU-Pro80.9%#57 / 129GPQA67.1%#144 / 211
维度与证据
抽象逻辑仅先验
科学与因果推理44.1
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.47 · q 1.00
hle · hle · z -0.75 · q 1.00
多步约束52.3
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.10 · q 1.00
证据整合与验证44.1
1 个基准族 · 1 个指标
lcr · lcr · z -1.15 · q 1.00
MMLU-ProV3 计分证据
站内排名#57
分数80.9%
更新时间2026年8月25日
置信度4
GPQAV3 计分证据
站内排名#144
分数67.1%
更新时间2026年8月25日
置信度4
HLEV3 计分证据
站内排名#157
分数4.9%
更新时间2026年8月25日
置信度4
AA-LCRV3 计分证据
站内排名#80
分数50.0
更新时间2026年8月20日
置信度1

知识

V3.0

5 个指标 · 暂定评分

分数41.180% 区间25.0–57.11/4 实测维度Artificial Analysis Intelligence Index14.5#95 / 111AA-GPQA Diamond67.1#90 / 108
维度与证据
广泛知识41.1
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -1.28 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#95
分数14.5
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#90
分数67.1
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#91
分数4.9
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#69
分数24.9
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#23
分数88.9
更新时间2026年8月20日
置信度1

数学

V3.0

4 个指标 · 估算

分数46.280% 区间36.9–55.43/4 实测维度AIME39.0%#34 / 68MATH-50088.9%#36 / 73
维度与证据
基础数学50.7
1 个基准族 · 1 个指标
math_500 · math_500 · z 0.13 · q 1.00
竞赛数学51.6
1 个基准族 · 1 个指标
aime · aime · z 0.19 · q 1.00
高阶证明36.1
1 个基准族 · 1 个指标
frontiermath · frontier_math_v2_tiers13 · z -2.20 · q 1.00
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#34
分数39.0%
更新时间2026年8月25日
置信度4
MATH-500V3 计分证据
站内排名#36
分数88.9%
更新时间2026年8月25日
置信度4
Math score
站内排名#60
分数25.2
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#46
分数0.7
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

2 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度AA-MMMU-Pro62.1#55 / 65Design Arena Website882.0#72 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
AA-MMMU-Pro
站内排名#55
分数62.1
更新时间2026年8月20日
置信度1
Design Arena Website
站内排名#72
分数882.0
更新时间2026年8月20日
置信度1

指令遵循

V3.0

1 个指标 · 暂定评分

分数44.380% 区间28.3–60.31/4 实测维度AA-IFBench43.0#62 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化44.3
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.04 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#62
分数43.0
更新时间2026年8月20日
置信度1

OpenRouter 端点

5 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Parasail
parasail/fp8
$0.350/M$1/M100.0%undefined tokens / undefined tokens
Google
google-vertex/us-east5
$0.350/M$1.15/M99.9%undefined tokens / undefined tokens
Novita
novita/fp8
$0.270/M$0.850/M99.8%undefined tokens / undefined tokens
DeepInfra
deepinfra/base
$0.200/M$0.800/M99.8%undefined tokens / undefined tokens
DigitalOcean
digitalocean
$0.200/M$0.696/M97.9%undefined tokens / —

价格对比

对比 Llama 4 Maverick 在 16 家服务商的 API 价格。价格从 $0.0038/M 到 $375.00/M,其中 云AI 提供最低价 $0.0038/M。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
99%
meta-llama/llama-4-maverick
default
$0.979/M
$3.92/M
L1
99%
llama-4-maverick-17b-128e-instruct
nvidia
$150.00/M
$150.00/M
L1
99%
meta-llama/llama-4-maverick-17b-128e-instruct
default
$10.27/M
$10.27/M
L1
100%
meta/llama-4-maverick-17b-128e-instruct
default
$375.00/M
$375.00/M
L1
100%
llama-4-maverick
default
$0.010/request
-
L1
100%
llama-4-maverick
mix
-99%$0.0038/M
-98%$0.019/M
L1
0%
llama-4-maverick-17b-128e-instruct
小叶币
$0.050/request
-
L1
0%
meta-llama/llama-4-maverick
default
$75.00/M
$75.00/M
L1
0%
llama-4-maverick-03-26-experimental
default
$75.00/M
$75.00/M
Dext API
免费
L1
19%
llama-4-maverick-17b-128e-instruct
公益
免费
免费
L1
0%
llama-4-maverick
nvidia
$1.00/request
-

替代方案与相似模型

常见问题

Llama 4 Maverick 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Llama 4 Maverick 的基准测试、API 价格、输出速度、首字延迟和 17 家服务商数据。
Llama 4 Maverick API 价格是多少?
Llama 4 Maverick17 家服务商有价格记录,价格从 $0.0038/M $375.00/M。最低价由 云AI 提供。
Llama 4 Maverick API 价格表包含什么?
Llama 4 Maverick API 价格表会对比 17 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Llama 4 Maverick API 价格最低?
云AI 当前提供 Llama 4 Maverick 的最低收录价格:$0.0038/M,共对比 17 家服务商。
Llama 4 Maverick 的 API 免费吗?
是的,Llama 4 Maverick 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Dext API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Llama 4 Maverick 免费 API?
LMSpeed 当前收录了 1 家 Llama 4 Maverick 免费 API 服务商,包括Dext API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Llama-4-Maverickllama-4-maverickllama-4-maverick-03-26-experimentalllama-4-maverick-17b-128e-instructmeta-llama/llama-4-maverick

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档