Meta
·Released on 2025年4月5日

Llama 4 Scout API 基准测试 价格和服务商数据

选择与 Llama 4 Scout 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Llama 4 Scout 页面汇总基准测试、API 价格和服务商数据,覆盖 24 家服务商,价格从 $0.0077/M 起。Llama 4 Scout 免费 API 额度来自 1 家服务商。页面同时展示实测速度和首字延迟。

Meta 的 Llama 4 Scout是语言模型,专为通用对话与文本生成任务优化。

质量
#91of 100
43.0
LMSpeed 评分
速度
#24of 77
75char/s
1.62 s
成本
#31of 181
$0.0077/ 1M · 8:1 in:out
$0.0012 in · $0.0064 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体32.7代码34.3综合推理41.8知识38.4数学44.4多语言-多模态-指令遵循43.2
#1数学44.4估算3/4 实测维度
80% 区间: 35.153.6
foundational math48.6
math_500 · math_500
competition math49.8
aime · aime
proof frontier34.7
frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#2指令遵循43.2暂定评分1/4 实测维度
80% 区间: 27.259.2
constraint following仅先验
structured output仅先验
novel instruction generalization43.2
ifbench · aa_if_bench
long multiturn instruction仅先验
#3综合推理41.8正式评分全站排名 #603/4 实测维度
80% 区间: 33.250.5
abstract logic仅先验
scientific causal42.1
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints47.8
mmlu_pro · mmlu_pro
evidence verification35.6
lcr · lcr
#4知识38.4暂定评分1/4 实测维度
80% 区间: 22.454.4
broad knowledge38.4
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#5代码34.3暂定评分1/4 实测维度
80% 区间: 20.448.2
code generation34.3
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
#6智能体32.7估算2/4 实测维度
80% 区间: 20.944.5
planning仅先验
tool use36.5
tau · tau2_bench
environment execution28.9
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliability仅先验
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.3Mtokens
1.6K pages of text
OUTPUT
16.4Ktokens
8K128K1M4M
1.3M

能力

Technical Details

输入
输出
总参数量
17B
发布日期
Apr 2025
知识截止
2024-08-31
Tokenizer
Llama4
架构
text+image->text
内容审核
支持参数
frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score43.0#91 / 100
Overall score
站内排名#91
分数43.0
更新时间2026年8月20日
置信度1

速度与延迟

2 个指标

输出速度133.0 tok/s#24 / 77首字延迟0.57 s#14 / 77
输出速度
Output speed
站内排名#24
分数133.0 tok/s
更新时间2026年9月1日
置信度4
首字延迟
Time to first token
站内排名#14
分数0.57 s
更新时间2026年9月1日
置信度4

价格

2 个指标

输入价格$0.180/M#31 / 181输出价格$0.660/M#31 / 181
输入价格
Input price
站内排名#31
分数$0.180/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#31
分数$0.660/M
更新时间2026年9月1日
置信度4

智能体

V3.0

3 个指标 · 估算

分数32.780% 区间20.9–44.52/4 实测维度AA Agentic Index1.1#64 / 65Τ²-bench results15.5#81 / 82
维度与证据
规划拆解仅先验
工具调用36.5
1 个基准族 · 1 个指标
tau · tau2_bench · z -1.91 · q 1.00
环境与长程执行28.9
1 个基准族 · 1 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z -3.00 · q 1.00
恢复与完成可靠性仅先验
AA Agentic Index
站内排名#64
分数1.1
更新时间2026年8月20日
置信度1
Τ²-bench resultsV3 计分证据
站内排名#81
分数15.5
更新时间2026年8月20日
置信度1
GDPval-AAV3 计分证据
站内排名#64
分数109.0
更新时间2026年8月20日
置信度1

代码

V3.0

4 个指标 · 暂定评分

分数34.380% 区间20.4–48.21/4 实测维度LiveCodeBench29.9%#89 / 115SciCode17.0%#201 / 206
维度与证据
代码生成34.3
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.51 · q 1.00
scicode · scicode · z -2.40 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#89
分数29.9%
更新时间2026年9月1日
置信度4
SciCodeV3 计分证据
站内排名#201
分数17.0%
更新时间2026年9月1日
置信度4
AA Coding Index
站内排名#70
分数8.2
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#107
分数17.0
更新时间2026年8月20日
置信度1

综合推理

V3.0

4 个指标 · 正式评分

分数41.8#6080% 区间33.2–50.53/4 实测维度MMLU-Pro75.2%#85 / 129GPQA58.7%#170 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理42.1
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.82 · q 1.00
hle · hle · z -0.92 · q 1.00
多步约束47.8
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -0.50 · q 1.00
证据整合与验证35.6
1 个基准族 · 1 个指标
lcr · lcr · z -2.28 · q 1.00
MMLU-ProV3 计分证据
站内排名#85
分数75.2%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#170
分数58.7%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#185
分数3.8%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#94
分数30.3
更新时间2026年8月20日
置信度1

知识

V3.0

5 个指标 · 暂定评分

分数38.480% 区间22.4–54.41/4 实测维度Artificial Analysis Intelligence Index10.3#103 / 111AA-GPQA Diamond58.7#98 / 108
维度与证据
广泛知识38.4
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -1.63 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#103
分数10.3
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#98
分数58.7
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#102
分数3.8
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#98
分数15.2
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#44
分数79.4
更新时间2026年8月20日
置信度1

数学

V3.0

3 个指标 · 估算

分数44.480% 区间35.1–53.63/4 实测维度AIME28.3%#42 / 68MATH-50084.4%#44 / 73
维度与证据
基础数学48.6
1 个基准族 · 1 个指标
math_500 · math_500 · z -0.16 · q 1.00
竞赛数学49.8
1 个基准族 · 1 个指标
aime · aime · z -0.05 · q 1.00
高阶证明34.7
1 个基准族 · 1 个指标
frontiermath · frontier_math_v2_tiers13 · z -2.39 · q 1.00
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#42
分数28.3%
更新时间2026年9月1日
置信度4
MATH-500V3 计分证据
站内排名#44
分数84.4%
更新时间2026年9月1日
置信度4
Math score
站内排名#60
分数25.2
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

2 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度AA-MMMU-Pro52.9#61 / 65Design Arena Website761.0#75 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
AA-MMMU-Pro
站内排名#61
分数52.9
更新时间2026年8月20日
置信度1
Design Arena Website
站内排名#75
分数761.0
更新时间2026年8月20日
置信度1

指令遵循

V3.0

1 个指标 · 暂定评分

分数43.280% 区间27.2–59.21/4 实测维度AA-IFBench39.5#70 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化43.2
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.18 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#70
分数39.5
更新时间2026年8月20日
置信度1

OpenRouter 端点

4 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Google
google-vertex/us-east5
$0.250/M$0.700/M99.9%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp8
$0.100/M$0.300/M99.9%undefined tokens / undefined tokens
Novita
novita/bf16
$0.180/M$0.590/M99.8%undefined tokens / undefined tokens
Groq
groq
$0.110/M$0.340/M98.4%undefined tokens / undefined tokens

价格对比

对比 Llama 4 Scout 在 23 家服务商的 API 价格。价格从 $0.0077/M 到 $77.05/M,其中 云AI 提供最低价 $0.0077/M。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
meta-llama/llama-4-scout
default
$3.75/M
$15.00/M
L1
100%
llama-4-scout
default
$0.300/M
$0.945/M
L1
99%
meta-llama/llama-4-scout
default
$0.490/M
$1.47/M
L1
99%
meta-llama/llama-4-scout-17b-16e-instruct
default
$10.27/M
$10.27/M
L1
100%
llama-4-scout
default
$0.010/request
-
L1
99%
llama-4-scout
default
-77%$0.041/M
-80%$0.129/M
L1
100%
llama-4-scout
mix
-96%$0.0077/M
-96%$0.024/M
L1
100%
llama-4-scout-17b-16e-instruct
Model
-89%$0.019/M
-91%$0.060/M
L1
100%
llama-4-scout-17b-16e-instruct
default
-54%$0.082/M
-61%$0.259/M
L1
100%
llama-4-scout
default
-54%$0.082/M
-61%$0.259/M
Dext API
免费
L1
54%
llama-4-scout-17b-16e-instruct
公益
免费
免费
L1
0%
llama-4-scout-17b-16e-instruct
小叶币
$0.050/request
-
L1
0%
llama-4-scout
default
-66%$0.062/M
-71%$0.194/M
L1
0%
llama-4-scout-17b
default
$75.00/M
$75.00/M
L1
0%
meta-llama/llama-4-scout
default
$75.00/M
$75.00/M
L1
0%
llama-4-scout
default
-77%$0.041/M
-80%$0.129/M
L1
0%
meta-llama/llama-4-scout
default
-35%$0.116/M
-34%$0.436/M

替代方案与相似模型

常见问题

Llama 4 Scout 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Llama 4 Scout 的基准测试、API 价格、输出速度、首字延迟和 24 家服务商数据。
Llama 4 Scout API 价格是多少?
Llama 4 Scout24 家服务商有价格记录,价格从 $0.0077/M $77.05/M。最低价由 云AI 提供。
Llama 4 Scout API 价格表包含什么?
Llama 4 Scout API 价格表会对比 24 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Llama 4 Scout API 价格最低?
云AI 当前提供 Llama 4 Scout 的最低收录价格:$0.0077/M,共对比 24 家服务商。
可以同时对比 Llama 4 Scout API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Llama 4 Scout API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Llama 4 Scout 的 API 免费吗?
是的,Llama 4 Scout 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Dext API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Llama 4 Scout 免费 API?
LMSpeed 当前收录了 1 家 Llama 4 Scout 免费 API 服务商,包括Dext API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Llama-4-Scoutllama-4-scoutllama-4-scout-17bllama-4-scout-17b-16e-instructmeta-llama/Llama-4-Scout-17B-16E-Instruct

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档