OpenAI
·Released on 2025年12月10日

GPT-5.2 API 基准测试 价格和服务商数据

选择与 GPT-5.2 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-5.2 页面汇总基准测试、API 价格和服务商数据,覆盖 1232 家服务商,价格从 $0.0027/request 起。GPT-5.2 免费 API 额度来自 16 家服务商。页面同时展示实测速度和首字延迟。

OpenAI 的 GPT-5.2是语言模型,专为通用对话与文本生成任务优化。

质量
#67of 100
51.0
LMSpeed 评分
速度
56char/s
3.43 s
成本
#137of 181
$0.0027/ 1M · 8:1 in:out
$0.0004 in · $0.0023 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体47.6代码56.2综合推理53.5知识57.7数学55.9多语言-多模态42.3指令遵循54.4
#1知识57.7暂定评分1/4 实测维度
80% 区间: 43.771.7
broad knowledge57.7
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#2代码56.2正式评分全站排名 #123/4 实测维度
80% 区间: 47.864.7
code generation59.9
livecodebench · livecodebench / scicode · scicode
repository engineering53.5
swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing55.4
swe_verified · swe_verified
tooling quality仅先验
#3数学55.9暂定评分1/4 实测维度
80% 区间: 39.972.0
foundational math仅先验
competition math仅先验
proof frontier55.9
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#4指令遵循54.4暂定评分1/4 实测维度
80% 区间: 38.470.4
constraint following仅先验
structured output仅先验
novel instruction generalization54.4
ifbench · aa_if_bench
long multiturn instruction仅先验
#5综合推理53.5正式评分全站排名 #284/4 实测维度
80% 区间: 47.160.0
abstract logic45.7
arc_agi · arc_agi2
scientific causal58
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints52.7
mmlu_pro · mmlu_pro
evidence verification57.7
lcr · lcr
#6智能体47.6正式评分全站排名 #404/4 实测维度
80% 区间: 41.054.2
planning48.7
deep_planning · gert_labs
tool use50.5
tau · tau2_bench
environment execution38.5
browsecomp · browse_comp / osworld · os_world_verified
recovery reliability52.8
jobbench · job_bench
#7多模态42.3估算3/4 实测维度
80% 区间: 33.351.4
perception ocr32.3
v_star · v_star
document spatial49.7
charxiv · charxiv
visual reasoning44.9
mathvision · math_vision / mmmu_pro · mmmu_pro
video action仅先验
暂无数据:多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
400Ktokens
480 pages of text
OUTPUT
128Ktokens
8K128K1M4M
400K

能力

Technical Details

输入
输出
发布日期
Dec 2025
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score51.0#67 / 100
Overall score
站内排名#67
分数51.0
更新时间2026年9月1日
置信度3

价格

2 个指标

输入价格$1.75/M#137 / 181输出价格$14.00/M#153 / 181
输入价格
Input price
站内排名#137
分数$1.75/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#153
分数$14.00/M
更新时间2026年9月1日
置信度4

智能体

V3.0

6 个指标 · 正式评分

分数47.6#4080% 区间41.0–54.24/4 实测维度Agentic score22.2#64 / 69BrowseComp65.8#24 / 31
维度与证据
规划拆解48.7
1 个基准族 · 1 个指标
deep_planning · gert_labs · z -0.15 · q 1.00
工具调用50.5
1 个基准族 · 1 个指标
tau · tau2_bench · z -0.05 · q 1.00
环境与长程执行38.5
2 个基准族 · 2 个指标
browsecomp · browse_comp · z -1.04 · q 1.00
osworld · os_world_verified · z -2.02 · q 1.00
恢复与完成可靠性52.8
1 个基准族 · 1 个指标
jobbench · job_bench · z 0.12 · q 1.00
Agentic score
站内排名#64
分数22.2
更新时间2026年9月1日
置信度3
BrowseCompV3 计分证据
站内排名#24
分数65.8
更新时间2026年9月1日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#26
分数47.3
更新时间2026年9月1日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#46
分数84.8
更新时间2026年9月1日
置信度3
Gert LabsV3 计分证据
站内排名#28
分数46.5
更新时间2026年9月1日
置信度3
JobBenchV3 计分证据
站内排名#9
分数34.3
更新时间2026年9月1日
置信度3

代码

V3.0

7 个指标 · 正式评分

分数56.2#1280% 区间47.8–64.73/4 实测维度LiveCodeBench66.9%#36 / 115SciCode40.4%#80 / 206
维度与证据
代码生成59.9
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 1.44 · q 1.00
scicode · scicode · z 0.76 · q 1.00
仓库工程53.5
2 个基准族 · 2 个指标
swe_pro · swe_pro · z -0.22 · q 1.00
vibecode · vibe_code_bench · z 0.97 · q 1.00
调试与测试55.4
1 个基准族 · 1 个指标
swe_verified · swe_verified · z 0.67 · q 1.00
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#36
分数66.9%
更新时间2026年9月1日
置信度4
SciCodeV3 计分证据
站内排名#80
分数40.4%
更新时间2026年9月1日
置信度4
Coding score
站内排名#50
分数51.5
更新时间2026年9月1日
置信度3
SWE-bench VerifiedV3 计分证据
站内排名#14
分数80.0
更新时间2026年9月1日
置信度3
SWE-bench ProV3 计分证据
站内排名#32
分数55.6
更新时间2026年9月1日
置信度3
Vibe Code BenchV3 计分证据
站内排名#6
分数53.5
更新时间2026年9月1日
置信度3
AA-SciCodeV3 计分证据
站内排名#25
分数52.1
更新时间2026年9月1日
置信度3

综合推理

V3.0

7 个指标 · 正式评分

分数53.5#2880% 区间47.1–60.04/4 实测维度MMLU-Pro87.4%#11 / 129GPQA71.2%#133 / 213
维度与证据
抽象逻辑45.7
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z -0.75 · q 1.00
科学与因果推理58
3 个基准族 · 3 个指标
critpt · critpt · z 0.62 · q 1.00
gpqa · gpqa · z 0.61 · q 1.00
hle · hle · z 0.54 · q 1.00
多步约束52.7
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.16 · q 1.00
证据整合与验证57.7
1 个基准族 · 1 个指标
lcr · lcr · z 0.67 · q 1.00
MMLU-ProV3 计分证据
站内排名#11
分数87.4%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#133
分数71.2%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#128
分数8.0%
更新时间2026年9月1日
置信度4
Reasoning score
站内排名#22
分数52.3
更新时间2026年9月1日
置信度3
ARC-AGI-2V3 计分证据
站内排名#13
分数52.9
更新时间2026年9月1日
置信度3
AA-LCRV3 计分证据
站内排名#8
分数79.3
更新时间2026年9月1日
置信度3
CritPtV3 计分证据
站内排名#27
分数11.6
更新时间2026年9月1日
置信度3

知识

V3.0

6 个指标 · 暂定评分

分数57.780% 区间43.7–71.71/4 实测维度Knowledge score83.7#10 / 69Artificial Analysis Intelligence Index43.3#29 / 111
维度与证据
广泛知识57.7
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.10 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 1.09 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#10
分数83.7
更新时间2026年9月1日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#29
分数43.3
更新时间2026年9月1日
置信度3
AA-GPQA Diamond
站内排名#27
分数90.3
更新时间2026年9月1日
置信度3
AA-HLE
站内排名#28
分数37.7
更新时间2026年9月1日
置信度3
AA-Omniscience Accuracy
站内排名#24
分数44.3
更新时间2026年9月1日
置信度3
AA-Omniscience Hallucination Rate
站内排名#40
分数81.2
更新时间2026年9月1日
置信度3

数学

V3.0

4 个指标 · 暂定评分

分数55.980% 区间39.9–72.01/4 实测维度Math score58.4#29 / 62AA AIME 202599.0#1 / 2
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明55.9
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.71 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.45 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#29
分数58.4
更新时间2026年9月1日
置信度3
AA AIME 2025
站内排名#1
分数99.0
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#10
分数40.7
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#11
分数18.8
更新时间2026年9月1日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

6 个指标 · 估算

分数42.380% 区间33.3–51.43/4 实测维度Multimodal Grounded score62.9#20 / 44MMMU-Pro79.5#11 / 31
维度与证据
感知与 OCR32.3
1 个基准族 · 1 个指标
v_star · v_star · z -2.61 · q 1.00
文档与空间理解49.7
1 个基准族 · 1 个指标
charxiv · charxiv · z 0.09 · q 1.00
视觉推理44.9
2 个基准族 · 2 个指标
mathvision · math_vision · z -1.24 · q 1.00
mmmu_pro · mmmu_pro · z 0.25 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#20
分数62.9
更新时间2026年9月1日
置信度3
MMMU-ProV3 计分证据
站内排名#11
分数79.5
更新时间2026年9月1日
置信度3
MathVisionV3 计分证据
站内排名#12
分数83.0
更新时间2026年9月1日
置信度3
CharXivV3 计分证据
站内排名#12
分数82.1
更新时间2026年9月1日
置信度3
V*V3 计分证据
站内排名#10
分数75.9
更新时间2026年9月1日
置信度3
Design Arena Website
站内排名#43
分数1214.0
更新时间2026年9月1日
置信度3

指令遵循

V3.0

1 个指标 · 暂定评分

分数54.480% 区间38.4–70.41/4 实测维度AA-IFBench75.4#19 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化54.4
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.32 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#19
分数75.4
更新时间2026年9月1日
置信度3

OpenRouter 端点

4 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
OpenAI
openai/fast
$3.50/M$28/M100%undefined tokens / undefined tokens
Azure
azure
$1.75/M$14/M99.5%undefined tokens / undefined tokens
OpenAI
openai
$1.75/M$14/M99.5%undefined tokens / undefined tokens
OpenAI
openai/flex
$0.875/M$7/Mundefined tokens / undefined tokens

价格对比

对比 GPT-5.2 在 1216 家服务商的 API 价格。价格从 $0.0027/request 到 $495.00/M,其中 Yun API 提供最低价 $0.0027/request。 16 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
69%
gpt-5.2
活动分组1
-94%$0.100/M
-94%$0.800/M
64.2 t/s
5.26 s
L1
100%
gpt-5.2
default
-86%$0.240/M
Cache read$0.024/M
-86%$1.92/M
58.7 t/s
1.63 s
L1
100%
gpt-5.2-chat
default
-86%$0.240/M
Cache read$0.024/M
-86%$1.92/M
51.4 t/s
2.14 s
L1
100%
gpt-5.2-chat-latest
default
-86%$0.240/M
Cache read$0.024/M
-86%$1.92/M
L1
99%
gpt-5.2-2025-12-11
AZvip
-86%$0.240/M
-86%$1.92/M
32.4 t/s
1.97 s
L1
99%
gpt-5.2
AZvip
$0.0027/request
-
L1
99%
gpt-5.2-xhigh
AZSVIP
-79%$0.360/M
-79%$2.88/M
L1
100%
gpt-5.2-chat-latest
default
-93%$0.120/M
Cache read$0.012/M
-93%$0.959/M
L1
100%
gpt-5.2-chat
default
-93%$0.120/M
Cache read$0.012/M
-93%$0.959/M
L1
100%
gpt-5.2
default
-93%$0.120/M
Cache read$0.012/M
-93%$0.959/M
L1
100%
gpt-5.2-2025-12-11
default
$1.75/M
$14.00/M
L1
100%
gpt-5.2
default
$1.75/M
$14.00/M
L1
100%
gpt-5.2-chat-latest
gf
$3.50/M
$28.00/M
L1
100%
gpt-5.2
default
$0.014/request
-
L1
100%
gpt-5.2-low
CodeX_05_token
-93%$0.120/M
-93%$0.959/M
L1
100%
gpt-5.2-medium
CodeX_05_token
-93%$0.120/M
-93%$0.959/M
L1
100%
gpt-5.2-2025-12-11
default
-86%$0.240/M
-86%$1.92/M
L1
100%
gpt-5.2-chat
default
-86%$0.240/M
-86%$1.92/M
L1
100%
gpt-5.2-openai-compact
default
-86%$0.240/M
-86%$1.92/M
L1
100%
gpt-5.2-xhigh
CodeX_05_token
-93%$0.120/M
-93%$0.959/M
当前显示 20 个模型 ID,共 204 个。

替代方案与相似模型

常见问题

GPT-5.2 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-5.2 的基准测试、API 价格、输出速度、首字延迟和 1232 家服务商数据。
GPT-5.2 API 价格是多少?
GPT-5.21232 家服务商有价格记录,价格从 $0.0027/request $495.00/M。最低价由 Yun API 提供。
GPT-5.2 API 价格表包含什么?
GPT-5.2 API 价格表会对比 1232 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-5.2 API 价格最低?
Yun API 当前提供 GPT-5.2 的最低收录价格:$0.0027/request,共对比 1232 家服务商。
可以同时对比 GPT-5.2 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GPT-5.2 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GPT-5.2 的 API 免费吗?
是的,GPT-5.2 免费 API 可通过 LMSpeed 上的 16 家服务商使用,包括Dext API, Moyanjdc API, Moyanjdc API, 初叶🍂Furry API, 180txt API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-5.2 免费 API?
LMSpeed 当前收录了 16 家 GPT-5.2 免费 API 服务商,包括Dext API, Moyanjdc API, Moyanjdc API, 初叶🍂Furry API, 180txt API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

15/gpt-5.264/gpt-5.264/gpt-5.2-2025-12-1164/gpt-5.2-chat-latestGPT-5.2

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档