OpenAI
·Released on 2026年3月17日

GPT-5.4 Mini API 基准测试 价格和服务商数据

选择与 GPT-5.4 Mini 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-5.4 Mini 页面汇总基准测试、API 价格和服务商数据,覆盖 959 家服务商,价格从 $0.0030/request 起。GPT-5.4 Mini 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

OpenAI 的 GPT-5.4 Mini是GPT-5.4 系列的轻量语言模型,专为低延迟、低成本的通用对话任务优化。

质量
#55of 100
55.0
LMSpeed 评分
速度
134char/s
3.54 s
成本
#105of 181
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体51代码57.5综合推理55.7知识46.1数学49.7多语言-多模态47.1指令遵循53.6
#1代码57.5估算2/4 实测维度
80% 区间: 45.769.4
code generation59.1
scicode · scicode
repository engineering56
vibecode · vibe_code_bench
debugging testing仅先验
tooling quality仅先验
#2综合推理55.7估算2/4 实测维度
80% 区间: 44.966.4
abstract logic仅先验
scientific causal57.1
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification54.2
lcr · lcr
#3指令遵循53.6暂定评分1/4 实测维度
80% 区间: 37.669.6
constraint following仅先验
structured output仅先验
novel instruction generalization53.6
ifbench · aa_if_bench
long multiturn instruction仅先验
#4智能体51正式评分全站排名 #323/4 实测维度
80% 区间: 42.959.2
planning仅先验
tool use48.4
mcp_atlas · mcp_atlas / tau · tau2_bench / toolathlon · toolathlon
environment execution50.9
gdpval_aa · benchlm_agentic_gdpval_aa / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability53.8
apex_agents · apex_agents_aa
#5数学49.7暂定评分1/4 实测维度
80% 区间: 33.665.7
foundational math仅先验
competition math仅先验
proof frontier49.7
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#6多模态47.1暂定评分1/4 实测维度
80% 区间: 31.063.3
perception ocr仅先验
document spatial仅先验
visual reasoning47.1
mmmu_pro · mmmu_pro
video action仅先验
#7知识46.1暂定评分1/4 实测维度
80% 区间: 32.160.1
broad knowledge46.1
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
暂无数据:多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
400Ktokens
480 pages of text
OUTPUT
128Ktokens
8K128K1M4M
400K

能力

Technical Details

输入
输出
发布日期
Mar 2026
知识截止
2025-08-31
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score55.0#55 / 100
Overall score
站内排名#55
分数55.0
更新时间2026年9月1日
置信度3

价格

2 个指标

输入价格$0.750/M#105 / 181输出价格$4.50/M#122 / 181
输入价格
Input price
站内排名#105
分数$0.750/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#122
分数$4.50/M
更新时间2026年9月1日
置信度4

智能体

V3.0

10 个指标 · 正式评分

分数51#3280% 区间42.9–59.23/4 实测维度Agentic score55.6#41 / 69Terminal-Bench 2.060.0#31 / 53
维度与证据
规划拆解仅先验
工具调用48.4
3 个基准族 · 3 个指标
mcp_atlas · mcp_atlas · z -1.22 · q 1.00
tau · tau2_bench · z 0.45 · q 1.00
toolathlon · toolathlon · z -0.52 · q 1.00
环境与长程执行50.9
3 个基准族 · 3 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.00 · q 1.00
osworld · os_world_verified · z -0.09 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.24 · q 1.00
恢复与完成可靠性53.8
1 个基准族 · 1 个指标
apex_agents · apex_agents_aa · z 0.21 · q 1.00
Agentic score
站内排名#41
分数55.6
更新时间2026年9月1日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#31
分数60.0
更新时间2026年9月1日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#16
分数72.1
更新时间2026年9月1日
置信度3
MCP AtlasV3 计分证据
站内排名#24
分数57.7
更新时间2026年9月1日
置信度3
ToolathlonV3 计分证据
站内排名#18
分数42.9
更新时间2026年9月1日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#29
分数93.4
更新时间2026年9月1日
置信度3
AA Agentic Index
站内排名#26
分数31.5
更新时间2026年9月1日
置信度3
APEX-Agents-AAV3 计分证据
站内排名#11
分数28.2
更新时间2026年9月1日
置信度3
GDPval-AA
站内排名#34
分数33.3
更新时间2026年9月1日
置信度3
GDPval-AAV3 计分证据
站内排名#34
分数1167.0
更新时间2026年9月1日
置信度3

代码

V3.0

7 个指标 · 估算

分数57.580% 区间45.7–69.42/4 实测维度SciCode44.2%#51 / 206Coding score52.7#44 / 81
维度与证据
代码生成59.1
1 个基准族 · 1 个指标
scicode · scicode · z 1.09 · q 1.00
仓库工程56
1 个基准族 · 1 个指标
vibecode · vibe_code_bench · z 0.79 · q 1.00
调试与测试仅先验
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#51
分数44.2%
更新时间2026年9月1日
置信度4
Coding score
站内排名#44
分数52.7
更新时间2026年9月1日
置信度3
Vibe Code BenchV3 计分证据
站内排名#10
分数48.0
更新时间2026年9月1日
置信度3
AA Coding Index
站内排名#31
分数56.1
更新时间2026年9月1日
置信度3
AA-SciCodeV3 计分证据
站内排名#29
分数49.9
更新时间2026年9月1日
置信度3
FrontierCode 1.1 Main
站内排名#8
分数27.0
更新时间2026年9月1日
置信度3
EEBench
站内排名#16
分数18.3
更新时间2026年8月20日
置信度3

综合推理

V3.0

4 个指标 · 估算

分数55.780% 区间44.9–66.42/4 实测维度GPQA82.3%#82 / 213HLE18.6%#85 / 210
维度与证据
抽象逻辑仅先验
科学与因果推理57.1
3 个基准族 · 4 个指标
critpt · critpt · z 0.55 · q 1.00
gpqa · gpqa · z 0.71 · q 1.00
hle · hle · z 0.59 · q 1.00
hle · hle_no_tools · z -1.54 · q 1.00
多步约束仅先验
证据整合与验证54.2
1 个基准族 · 1 个指标
lcr · lcr · z 0.20 · q 1.00
GPQAV3 计分证据
站内排名#82
分数82.3%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#85
分数18.6%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#39
分数73.0
更新时间2026年9月1日
置信度3
CritPtV3 计分证据
站内排名#29
分数10.0
更新时间2026年9月1日
置信度3

知识

V3.0

7 个指标 · 暂定评分

分数46.180% 区间32.1–60.11/4 实测维度Knowledge score57.3#52 / 69HLE w/o tools28.2#20 / 21
维度与证据
广泛知识46.1
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z -0.50 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z -0.61 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#52
分数57.3
更新时间2026年9月1日
置信度3
HLE w/o tools
站内排名#20
分数28.2
更新时间2026年9月1日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#40
分数40.9
更新时间2026年9月1日
置信度3
AA-GPQA Diamond
站内排名#42
分数87.5
更新时间2026年9月1日
置信度3
AA-HLE
站内排名#50
分数28.1
更新时间2026年9月1日
置信度3
AA-Omniscience Accuracy
站内排名#40
分数37.5
更新时间2026年9月1日
置信度3
AA-Omniscience Hallucination Rate
站内排名#18
分数90.2
更新时间2026年9月1日
置信度3

数学

V3.0

3 个指标 · 暂定评分

分数49.780% 区间33.6–65.71/4 实测维度Math score44.6#38 / 62FrontierMath v2 (Tiers 1-3)28.3#20 / 47
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明49.7
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z -0.65 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.13 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#38
分数44.6
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#20
分数28.3
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#35
分数2.1
更新时间2026年9月1日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

4 个指标 · 暂定评分

分数47.180% 区间31.0–63.31/4 实测维度Multimodal Grounded score51.3#32 / 44MMMU-Pro76.6#22 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理47.1
1 个基准族 · 1 个指标
mmmu_pro · mmmu_pro · z -0.45 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#32
分数51.3
更新时间2026年9月1日
置信度3
MMMU-ProV3 计分证据
站内排名#22
分数76.6
更新时间2026年9月1日
置信度3
MMMU-Pro w/ Python
站内排名#8
分数78.0
更新时间2026年9月1日
置信度3
AA-MMMU-Pro
站内排名#40
分数73.3
更新时间2026年9月1日
置信度3

指令遵循

V3.0

1 个指标 · 暂定评分

分数53.680% 区间37.6–69.61/4 实测维度AA-IFBench73.3#24 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化53.6
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.21 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#24
分数73.3
更新时间2026年9月1日
置信度3

OpenRouter 端点

5 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
OpenAI
openai/fast
$1.50/M$9/M99.8%undefined tokens / undefined tokens
OpenAI
openai
$0.750/M$4.50/M99.8%undefined tokens / undefined tokens
OpenAI
openai/flex
$0.375/M$2.25/M99.7%undefined tokens / undefined tokens
Azure
azure
$0.750/M$4.50/M98.2%undefined tokens / undefined tokens
Azure
azure/us
$0.825/M$4.95/M90.0%undefined tokens / undefined tokens

价格对比

对比 GPT-5.4 Mini 在 954 家服务商的 API 价格。价格从 $0.0030/request 到 $7492.50/M,其中 Crond 提供最低价 $0.0030/request。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
0%
gpt-5.4-mini
default
$0.750/M
Cache read$0.075/M
$4.50/M
245.0 t/s
2.62 s
L1
100%
gpt-5.4-mini
default
-93%$0.051/M
Cache read$0.0051/M
-93%$0.308/M
200.7 t/s
1.44 s
L1
100%
gpt-5.4-mini-2026-03-17
default
-93%$0.051/M
-93%$0.308/M
L1
97%
gpt-5.4-mini
default
$0.750/M
Cache read$0.075/M
$4.50/M
139.4 t/s
2.84 s
L1
100%
gpt-5.4-mini
default
$0.750/M
Cache read$0.075/M
$4.50/M
97.9 t/s
4.04 s
L1
99%
gpt-5.4-mini
GPT-Entry
-97%$0.022/M
Cache read$0.0022/M
-97%$0.135/M
94.8 t/s
2.34 s
L1
100%
gpt-5.4-mini
codex
-93%$0.054/M
Cache read$0.0054/M
-93%$0.321/M
L1
100%
gpt-5.4-mini
GPT · 最佳现金等价值(条件优惠)
-95%$0.037/M
Cache read$0.0037/M
-95%$0.225/M
L1
100%
gpt-5.4-mini
default
$0.750/M
$4.50/M
L1
100%
gpt-5.4-mini-xhigh
default
$0.750/M
$4.50/M
L1
100%
gpt-5.4-mini-medium
default
$0.750/M
$4.50/M
L1
100%
gpt-5.4-mini-low
default
$0.750/M
$4.50/M
L1
100%
gpt-5.4-mini-high
default
$0.750/M
$4.50/M
L1
100%
gpt-5.4-mini-2026-03-17
default
$0.750/M
$4.50/M
L1
99%
gpt-5.4-mini
Codex-Plus
-99%$0.0044/M
Cache read$0.0004/MCache write$0.0055/MCache write 1h$0.0088/M
-99%$0.026/M
L1
100%
gpt-5.4-mini
default
-86%$0.103/M
-86%$0.616/M
L1
100%
gpt-5.4-mini-2026-03-17
default
-86%$0.103/M
-86%$0.616/M
L1
100%
gpt-5.4-mini-high
default
-86%$0.103/M
-86%$0.616/M
L1
100%
gpt-5.4-mini-medium
default
-86%$0.103/M
-86%$0.616/M
L1
100%
gpt-5.4-mini
default
-86%$0.103/M
Cache read$0.010/M
-86%$0.616/M
当前显示 20 个模型 ID,共 170 个。

替代方案与相似模型

常见问题

GPT-5.4 Mini 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-5.4 Mini 的基准测试、API 价格、输出速度、首字延迟和 959 家服务商数据。
GPT-5.4 Mini API 价格是多少?
GPT-5.4 Mini959 家服务商有价格记录,价格从 $0.0030/request $7492.50/M。最低价由 Crond 提供。
GPT-5.4 Mini API 价格表包含什么?
GPT-5.4 Mini API 价格表会对比 959 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-5.4 Mini API 价格最低?
Crond 当前提供 GPT-5.4 Mini 的最低收录价格:$0.0030/request,共对比 959 家服务商。
可以同时对比 GPT-5.4 Mini API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GPT-5.4 Mini API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GPT-5.4 Mini 的 API 免费吗?
是的,GPT-5.4 Mini 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括兔子API, 兔子API, Moyanjdc API, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-5.4 Mini 免费 API?
LMSpeed 当前收录了 5 家 GPT-5.4 Mini 免费 API 服务商,包括兔子API, 兔子API, Moyanjdc API, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

11/gpt-5.4-mini15/gpt-5.4-mini64/gpt-5.4-miniCPA/gpt-5.4-miniGPT-5.4 Mini

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档