OpenAI
·Released on 2025年4月14日

GPT-4.1 API 基准测试 价格和服务商数据

选择与 GPT-4.1 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-4.1 页面汇总基准测试、API 价格和服务商数据,覆盖 794 家服务商,价格从 $0.020/request 起。GPT-4.1 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

OpenAI 的 GPT-4.1是语言模型,专为通用对话与文本生成任务优化。

质量
#81of 100
46.0
LMSpeed 评分
速度
85char/s
1.92 s
成本
#139of 180
$0.020/ 1M · 8:1 in:out
$0.0032 in · $0.017 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体40代码38.3综合推理48.5知识57数学49多语言-多模态-指令遵循42.1
#1知识57暂定评分1/4 实测维度
80% 区间: 39.574.4
broad knowledge57
mmlu · mmlu
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#2数学49估算3/4 实测维度
80% 区间: 39.858.3
foundational math52.2
math_500 · math_500
competition math52.4
aime · aime
proof frontier42.5
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#3综合推理48.5正式评分全站排名 #483/4 实测维度
80% 区间: 39.957.2
abstract logic仅先验
scientific causal43.6
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints52
mmlu_pro · mmlu_pro
evidence verification50
lcr · lcr
#4指令遵循42.1估算2/4 实测维度
80% 区间: 30.254.0
constraint following39.9
ifeval · ifeval
structured output仅先验
novel instruction generalization44.3
ifbench · aa_if_bench
long multiturn instruction仅先验
#5智能体40估算2/4 实测维度
80% 区间: 28.251.8
planning37
deep_planning · gert_labs
tool use43
tau · tau2_bench
environment execution仅先验
recovery reliability仅先验
#6代码38.3估算2/4 实测维度
80% 区间: 27.149.4
code generation48.7
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing27.9
swe_verified · swe_verified
tooling quality仅先验
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
32.8Ktokens
8K128K1M4M
1.0M

能力

Technical Details

输入
输出
发布日期
Apr 2025
知识截止
2024-06-30
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
max_completion_tokensmax_tokensresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月31日

综合

1 个指标

Overall score46.0#81 / 100
Overall score
站内排名#81
分数46.0
更新时间2026年8月20日
置信度1

价格

2 个指标

输入价格$2.00/M#139 / 180输出价格$8.00/M#134 / 180
输入价格
Input price
站内排名#139
分数$2.00/M
更新时间2026年8月31日
置信度4
输出价格
Output price
站内排名#134
分数$8.00/M
更新时间2026年8月31日
置信度4

智能体

V3.0

2 个指标 · 估算

分数4080% 区间28.2–51.82/4 实测维度Τ²-bench results47.1#67 / 82Gert Labs25.6#49 / 49
维度与证据
规划拆解37
1 个基准族 · 1 个指标
deep_planning · gert_labs · z -1.72 · q 1.00
工具调用43
1 个基准族 · 1 个指标
tau · tau2_bench · z -1.05 · q 1.00
环境与长程执行仅先验
恢复与完成可靠性仅先验
Τ²-bench resultsV3 计分证据
站内排名#67
分数47.1
更新时间2026年8月20日
置信度1
Gert LabsV3 计分证据
站内排名#49
分数25.6
更新时间2026年8月20日
置信度1

代码

V3.0

5 个指标 · 估算

分数38.380% 区间27.1–49.42/4 实测维度LiveCodeBench45.7%#65 / 115SciCode38.1%#107 / 205
维度与证据
代码生成48.7
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.07 · q 1.00
scicode · scicode · z 0.01 · q 1.00
仓库工程仅先验
调试与测试27.9
1 个基准族 · 1 个指标
swe_verified · swe_verified · z -3.00 · q 1.00
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#65
分数45.7%
更新时间2026年8月31日
置信度4
SciCodeV3 计分证据
站内排名#107
分数38.1%
更新时间2026年8月31日
置信度4
Coding score
站内排名#78
分数23.6
更新时间2026年8月20日
置信度1
SWE-bench VerifiedV3 计分证据
站内排名#45
分数54.6
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#78
分数38.1
更新时间2026年8月20日
置信度1

综合推理

V3.0

4 个指标 · 正式评分

分数48.5#4880% 区间39.9–57.23/4 实测维度MMLU-Pro80.6%#59 / 129GPQA66.6%#148 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理43.6
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.50 · q 1.00
hle · hle · z -0.85 · q 1.00
多步约束52
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.07 · q 1.00
证据整合与验证50
1 个基准族 · 1 个指标
lcr · lcr · z -0.35 · q 1.00
MMLU-ProV3 计分证据
站内排名#59
分数80.6%
更新时间2026年8月31日
置信度4
GPQAV3 计分证据
站内排名#148
分数66.6%
更新时间2026年8月31日
置信度4
HLEV3 计分证据
站内排名#170
分数4.2%
更新时间2026年8月31日
置信度4
AA-LCRV3 计分证据
站内排名#70
分数64.3
更新时间2026年8月20日
置信度1

知识

V3.0

7 个指标 · 暂定评分

分数5780% 区间39.5–74.41/4 实测维度Knowledge score54.1#56 / 69MMLU90.2#2 / 5
维度与证据
广泛知识57
1 个基准族 · 1 个指标
mmlu · mmlu · z 1.13 · q 0.21
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#56
分数54.1
更新时间2026年8月20日
置信度1
MMLUV3 计分证据
站内排名#2
分数90.2
更新时间2026年8月20日
置信度1
Artificial Analysis Intelligence Index
站内排名#86
分数19.6
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#91
分数66.6
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#96
分数4.2
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#57
分数27.8
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#4
分数93.3
更新时间2026年8月20日
置信度1

数学

V3.0

4 个指标 · 估算

分数4980% 区间39.8–58.33/4 实测维度AIME43.7%#31 / 68MATH-50091.3%#30 / 73
维度与证据
基础数学52.2
1 个基准族 · 1 个指标
math_500 · math_500 · z 0.33 · q 1.00
竞赛数学52.4
1 个基准族 · 1 个指标
aime · aime · z 0.29 · q 1.00
高阶证明42.5
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z -1.47 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z -0.97 · q 1.00
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#31
分数43.7%
更新时间2026年8月31日
置信度4
MATH-500V3 计分证据
站内排名#30
分数91.3%
更新时间2026年8月31日
置信度4
Math score
站内排名#53
分数28.1
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#37
分数5.5
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

2 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度AA-MMMU-Pro61.2#56 / 65Design Arena Website1050.0#67 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
AA-MMMU-Pro
站内排名#56
分数61.2
更新时间2026年8月20日
置信度1
Design Arena Website
站内排名#67
分数1050.0
更新时间2026年8月20日
置信度1

指令遵循

V3.0

3 个指标 · 估算

分数42.180% 区间30.2–54.02/4 实测维度Instruction Following score72.0#21 / 25IFEval87.4#14 / 16
维度与证据
约束遵循39.9
1 个基准族 · 1 个指标
ifeval · ifeval · z -1.54 · q 1.00
结构化输出仅先验
新指令泛化44.3
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.04 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#21
分数72.0
更新时间2026年8月20日
置信度1
IFEvalV3 计分证据
站内排名#14
分数87.4
更新时间2026年8月20日
置信度1
AA-IFBenchV3 计分证据
站内排名#62
分数43.0
更新时间2026年8月20日
置信度1

OpenRouter 端点

3 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Azure
azure/swedencentral
$2.20/M$8.80/M100%undefined tokens / undefined tokens
Azure
azure
$2/M$8/M100.0%undefined tokens / undefined tokens
OpenAI
openai
$2/M$8/M99.3%undefined tokens / undefined tokens

价格对比

对比 GPT-4.1 在 789 家服务商的 API 价格。价格从 $0.020/request 到 $300.00/M,其中 Meta API 提供最低价 $0.020/request。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
65%
gpt-4.1
活动分组1
-94%$0.114/M
-94%$0.457/M
78.5 t/s
2.30 s
L1
65%
gpt-4.1-2025-04-14
活动分组1
-94%$0.114/M
-94%$0.457/M
L1
100%
gpt-4.1
default
-93%$0.137/M
Cache read$0.068/M
-93%$0.548/M
L1
100%
gpt-4.1-2025-04-14
default
-93%$0.137/M
Cache read$0.034/M
-93%$0.548/M
L1
100%
gpt-4.1
azure-officially
-29%$1.43/M
Cache read$0.357/M
-64%$2.86/M
L1
100%
gpt-4.1
default
$2.00/M
$8.00/M
L1
100%
gpt-4.1-2025-04-14
default
$2.00/M
$8.00/M
L1
100%
gpt-4.1
default
-86%$0.274/M
Cache read$0.137/M
-86%$1.10/M
L1
100%
gpt-4.1-2025-04-14
default
-86%$0.274/M
Cache read$0.068/M
-86%$1.10/M
L1
100%
gpt-4.1
default
-86%$0.274/M
-86%$1.10/M
L1
100%
gpt-4.1-2025-04-14
default
-86%$0.274/M
-86%$1.10/M
L1
100%
gpt-4.1-2025-04-14
default
$2.00/M
$8.00/M
L1
100%
gpt-4.1
default
$2.00/M
$8.00/M
兔子API
免费
L1
100%
gpt-4.1
default
免费
免费
L1
100%
gpt-4.1-2025-04-14
原价分组
免费
免费
L1
100%
gpt-4.1
default
-96%$0.082/M
Cache read$0.041/M
-96%$0.329/M
L1
100%
gpt-4.1-2025-04-14
default
-96%$0.082/M
Cache read$0.021/M
-96%$0.329/M
L1
100%
gpt-4.1
gpt-azure
-73%$0.531/M
Cache read$0.133/M
-87%$1.06/M
L1
100%
gpt-4.1
gpt-azure2
-30%$1.40/M
Cache read$0.350/M
-30%$5.60/M
L1
100%
gpt-4.1-2025-04-14
gpt-azure
$2.00/M
$8.00/M
当前显示 20 个模型 ID,共 108 个。

替代方案与相似模型

常见问题

GPT-4.1 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-4.1 的基准测试、API 价格、输出速度、首字延迟和 794 家服务商数据。
GPT-4.1 API 价格是多少?
GPT-4.1794 家服务商有价格记录,价格从 $0.020/request $300.00/M。最低价由 Meta API 提供。
GPT-4.1 API 价格表包含什么?
GPT-4.1 API 价格表会对比 794 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-4.1 API 价格最低?
Meta API 当前提供 GPT-4.1 的最低收录价格:$0.020/request,共对比 794 家服务商。
可以同时对比 GPT-4.1 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GPT-4.1 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GPT-4.1 的 API 免费吗?
是的,GPT-4.1 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括兔子API, Dext API, 兔子API, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-4.1 免费 API?
LMSpeed 当前收录了 5 家 GPT-4.1 免费 API 服务商,包括兔子API, Dext API, 兔子API, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

copilot/gpt-4.1copilot/gpt-4.1-2025-04-14gpt-4-1gpt-4.1gpt-4.1-2025-04-14

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档