OpenAI
·Released on 2026年4月24日

GPT-5.5 API 基准测试 价格和服务商数据

选择与 GPT-5.5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-5.5 页面汇总基准测试、API 价格和服务商数据,覆盖 629 家服务商,价格从 $0.0089/M 起。GPT-5.5 免费 API 额度来自 42 家服务商。页面同时展示实测速度和首字延迟。

GPT-5.5 is OpenAI’s frontier model designed for complex professional workloads, building on GPT-5.4 with stronger reasoning, higher reliability, and improved token efficiency on hard tasks. It feature...

质量
#20of 112
69.0
LMSpeed 评分
速度
46char/s
4.95 s
成本
#168of 186
$0.0089/ 1M · 8:1 in:out
$0.0014 in · $0.0075 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体60.9代码59.3综合推理58.8知识58.5数学56.2多语言-多模态55.7指令遵循54.8
#1智能体60.9正式评分全站排名 #114/4 实测维度
80% 区间: 55.866.0
planning63
deep_planning · gert_labs
tool use60.6
mcp_atlas · mcp_atlas / tau · tau2_bench / toolathlon · toolathlon
environment execution61
browsecomp · browse_comp / enterprise_ops_gym · aa_enterprise_ops_gym / gdpval_aa · benchlm_agentic_gdpval_aa / itbench · aa_itbench / osworld · os_world2 / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability58.9
apex_agents · apex_agents_aa / cyber_gym · cyber_gym / exploit_gym · exploit_gym / jobbench · job_bench / researchclaw · research_claw_bench
#2代码59.3正式评分全站排名 #63/4 实测维度
80% 区间: 50.568.0
code generation60.7
scicode · scicode
repository engineering59.5
react_native_bench · react_native_evals / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing仅先验
tooling quality57.6
terminalbench · benchlm_coding_terminal_bench2 / terminalbench · terminal_bench_hard
#3综合推理58.8正式评分全站排名 #83/4 实测维度
80% 区间: 50.167.6
abstract logic55.1
arc_agi · arc_agi2
scientific causal62.6
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification58.8
lcr · lcr
#4知识58.5暂定评分1/4 实测维度
80% 区间: 44.572.5
broad knowledge58.5
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#5数学56.2暂定评分1/4 实测维度
80% 区间: 40.172.3
foundational math仅先验
competition math仅先验
proof frontier56.2
frontiermath · frontier_math / frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#6多模态55.7暂定评分1/4 实测维度
80% 区间: 39.671.8
perception ocr仅先验
document spatial仅先验
visual reasoning55.7
mmmu_pro · mmmu_pro
video action仅先验
#7指令遵循54.8暂定评分1/4 实测维度
80% 区间: 38.870.8
constraint following仅先验
structured output仅先验
novel instruction generalization54.8
ifbench · aa_if_bench
long multiturn instruction仅先验
暂无数据:多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.1Mtokens
1.3K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1.1M

能力

Technical Details

输入
输出
发布日期
Apr 2026
知识截止
2025-12-01
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月13日

综合

9 个指标

Overall score69.0#20 / 112SEC-Bench Pro45.8#3 / 3
Overall score
站内排名#20
分数69.0
更新时间2026年9月13日
置信度4
SEC-Bench Pro
站内排名#3
分数45.8
更新时间2026年9月13日
置信度4
Atomic network attacks
站内排名#1
分数100.0
更新时间2026年9月13日
置信度4
Atomic vulnerability research
站内排名#2
分数92.0
更新时间2026年9月13日
置信度4
Atomic evasion
站内排名#2
分数54.0
更新时间2026年9月13日
置信度4
Factuality hallucination rate
站内排名#3
分数1.1
更新时间2026年8月20日
置信度3
SecureCodeReview
站内排名#1
分数64.1
更新时间2026年8月20日
置信度3
HackerBench harmful compliance
站内排名#2
分数25.0
更新时间2026年8月20日
置信度3
HackerBench benign refusal
站内排名#1
分数1.1
更新时间2026年8月20日
置信度3

价格

2 个指标

输入价格$5.00/M#168 / 186输出价格$30.00/M#174 / 186
输入价格
Input price
站内排名#168
分数$5.00/M
更新时间2026年9月13日
置信度4
输出价格
Output price
站内排名#174
分数$30.00/M
更新时间2026年9月13日
置信度4

智能体

V3.0

23 个指标 · 正式评分

分数60.9#1180% 区间55.8–66.04/4 实测维度Agentic score77.6#20 / 77Terminal-Bench 2.082.0#7 / 53
维度与证据
规划拆解63
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 1.75 · q 1.00
工具调用60.6
3 个基准族 · 3 个指标
mcp_atlas · mcp_atlas · z 0.18 · q 1.00
tau · tau2_bench · z 1.16 · q 1.00
toolathlon · toolathlon · z 0.77 · q 1.00
环境与长程执行61
6 个基准族 · 7 个指标
browsecomp · browse_comp · z 0.28 · q 1.00
enterprise_ops_gym · aa_enterprise_ops_gym · z 0.35 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.58 · q 1.00
itbench · aa_itbench · z 0.32 · q 1.00
osworld · os_world2 · z -0.36 · q 1.00
osworld · os_world_verified · z 0.56 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 1.40 · q 1.00
恢复与完成可靠性58.9
5 个基准族 · 5 个指标
apex_agents · apex_agents_aa · z 0.75 · q 1.00
cyber_gym · cyber_gym · z 0.51 · q 1.00
exploit_gym · exploit_gym · z 0.00 · q 0.58
jobbench · job_bench · z 0.45 · q 1.00
researchclaw · research_claw_bench · z -0.32 · q 1.00
Agentic score
站内排名#20
分数77.6
更新时间2026年9月13日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#7
分数82.0
更新时间2026年9月13日
置信度4
CyberGymV3 计分证据
站内排名#3
分数81.8
更新时间2026年9月13日
置信度4
BrowseCompV3 计分证据
站内排名#9
分数84.4
更新时间2026年9月13日
置信度4
OSWorld-VerifiedV3 计分证据
站内排名#8
分数78.7
更新时间2026年9月13日
置信度4
MCP AtlasV3 计分证据
站内排名#12
分数75.3
更新时间2026年9月13日
置信度4
ToolathlonV3 计分证据
站内排名#5
分数55.6
更新时间2026年9月13日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#8
分数98.0
更新时间2026年9月13日
置信度4
AA Agentic Index
站内排名#23
分数37.3
更新时间2026年9月13日
置信度4
APEX-Agents-AAV3 计分证据
站内排名#4
分数37.7
更新时间2026年9月13日
置信度4
GDPval-AA
站内排名#22
分数44.8
更新时间2026年9月13日
置信度4
GDPval-AAV3 计分证据
站内排名#22
分数1396.0
更新时间2026年9月13日
置信度4
Gert LabsV3 计分证据
站内排名#2
分数72.9
更新时间2026年9月13日
置信度4
ResearchClawBenchV3 计分证据
站内排名#11
分数17.0
更新时间2026年9月13日
置信度4
OSWorld 2.0V3 计分证据
站内排名#15
分数13.0
更新时间2026年9月13日
置信度4
JobBenchV3 计分证据
站内排名#6
分数42.7
更新时间2026年9月13日
置信度4
ExploitGymV3 计分证据
站内排名#4
分数13.4
更新时间2026年9月13日
置信度4
AA EnterpriseOps-GymV3 计分证据
站内排名#8
分数46.6
更新时间2026年9月13日
置信度4
AA ITBenchV3 计分证据
站内排名#5
分数45.8
更新时间2026年9月13日
置信度4
Terminal-Bench 2.1 (Vals)
站内排名#12
分数76.4
更新时间2026年9月13日
置信度4
AA-AnalystAgent
站内排名#5
分数50.0
更新时间2026年9月13日
置信度4
ApprenticeBench
站内排名#7
分数20.0
更新时间2026年9月13日
置信度4
AA AutomationBench
站内排名#19
分数42.1
更新时间2026年8月20日
置信度3

代码

V3.0

19 个指标 · 正式评分

分数59.3#680% 区间50.5–68.03/4 实测维度SciCode54.5%#16 / 89Coding score51.9#51 / 87
维度与证据
代码生成60.7
1 个基准族 · 1 个指标
scicode · scicode · z 1.26 · q 1.00
仓库工程59.5
3 个基准族 · 3 个指标
react_native_bench · react_native_evals · z 0.89 · q 1.00
swe_pro · swe_pro · z 0.26 · q 1.00
vibecode · vibe_code_bench · z 1.52 · q 1.00
调试与测试仅先验
工具化开发与质量57.6
1 个基准族 · 2 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 1.02 · q 1.00
terminalbench · terminal_bench_hard · z 0.75 · q 1.00
SciCodeV3 计分证据
站内排名#16
分数54.5%
更新时间2026年9月13日
置信度4
Coding score
站内排名#51
分数51.9
更新时间2026年9月13日
置信度4
SWE-bench ProV3 计分证据
站内排名#18
分数58.6
更新时间2026年9月13日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#6
分数82.0
更新时间2026年9月13日
置信度4
Vibe Code BenchV3 计分证据
站内排名#2
分数69.8
更新时间2026年9月13日
置信度4
React Native EvalsV3 计分证据
站内排名#2
分数84.7
更新时间2026年9月13日
置信度4
CursorBench v3.1
站内排名#2
分数59.2
更新时间2026年9月13日
置信度4
AA Coding Index
站内排名#12
分数74.9
更新时间2026年9月13日
置信度4
AA-SciCodeV3 计分证据
站内排名#16
分数55.8
更新时间2026年9月13日
置信度4
CursorBench v3.2
站内排名#13
分数58.4
更新时间2026年9月13日
置信度4
FrontierCode 1.1 Main
站内排名#6
分数43.0
更新时间2026年9月13日
置信度4
Terminal-Bench HardV3 计分证据
站内排名#3
分数60.6
更新时间2026年9月13日
置信度4
LiveCodeBench (Vals)
站内排名#23
分数85.3
更新时间2026年9月13日
置信度4
SWE-bench (Vals)
站内排名#16
分数82.6
更新时间2026年9月13日
置信度4
APEX-SWE
站内排名#8
分数37.0
更新时间2026年8月20日
置信度3
EEBench
站内排名#6
分数42.3
更新时间2026年8月20日
置信度3
CADGenBench Generation
站内排名#5
分数29.7
更新时间2026年8月20日
置信度3
SpaceXAI MTS Eval
站内排名#5
分数46.4
更新时间2026年8月20日
置信度3
InferenceEval
站内排名#6
分数38.9
更新时间2026年8月20日
置信度3

综合推理

V3.0

9 个指标 · 正式评分

分数58.8#880% 区间50.1–67.63/4 实测维度GPQA93.5%#8 / 218HLE45.8%#16 / 216
维度与证据
抽象逻辑55.1
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z 0.59 · q 1.00
科学与因果推理62.6
3 个基准族 · 4 个指标
critpt · critpt · z 0.94 · q 1.00
gpqa · gpqa · z 1.19 · q 1.00
hle · hle · z 0.93 · q 1.00
hle · hle_no_tools · z -0.14 · q 1.00
多步约束仅先验
证据整合与验证58.8
1 个基准族 · 1 个指标
lcr · lcr · z 0.82 · q 1.00
GPQAV3 计分证据
站内排名#8
分数93.5%
更新时间2026年9月13日
置信度4
HLEV3 计分证据
站内排名#16
分数45.8%
更新时间2026年9月13日
置信度4
Reasoning score
站内排名#43
分数64.0
更新时间2026年9月13日
置信度4
MRCR v2 64K-128K
站内排名#2
分数83.1
更新时间2026年9月13日
置信度4
MRCR v2 128K-256K
站内排名#1
分数87.5
更新时间2026年9月13日
置信度4
ARC-AGI-2V3 计分证据
站内排名#5
分数85.0
更新时间2026年9月13日
置信度4
AA-LCRV3 计分证据
站内排名#3
分数84.3
更新时间2026年9月13日
置信度4
CritPtV3 计分证据
站内排名#9
分数27.1
更新时间2026年9月13日
置信度4
ARC-AGI-3
站内排名#6
分数0.4
更新时间2026年9月13日
置信度4

知识

V3.0

11 个指标 · 暂定评分

分数58.580% 区间44.5–72.51/4 实测维度Knowledge score78.8#22 / 83GPQA-D93.6#5 / 32
维度与证据
广泛知识58.5
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.81 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.55 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#22
分数78.8
更新时间2026年9月13日
置信度4
GPQA-D
站内排名#5
分数93.6
更新时间2026年9月13日
置信度4
HLE w/o tools
站内排名#12
分数41.4
更新时间2026年9月13日
置信度4
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#31
分数38.6
更新时间2026年9月13日
置信度4
AA-GPQA Diamond
站内排名#8
分数93.5
更新时间2026年9月13日
置信度4
AA-HLE
站内排名#13
分数45.8
更新时间2026年9月13日
置信度4
AA-Omniscience IndexV3 计分证据
站内排名#18
分数20.5
更新时间2026年9月13日
置信度4
AA-Omniscience Accuracy
站内排名#6
分数58.0
更新时间2026年9月13日
置信度4
AA-Omniscience Hallucination Rate
站内排名#22
分数89.0
更新时间2026年9月13日
置信度4
GPQA Diamond (Vals)
站内排名#10
分数93.2
更新时间2026年9月13日
置信度4
MMLU-Pro (Vals)
站内排名#18
分数88.1
更新时间2026年9月13日
置信度4

数学

V3.0

4 个指标 · 暂定评分

分数56.280% 区间40.1–72.31/4 实测维度Math score69.6#21 / 63FrontierMath (legacy)51.7#5 / 7
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明56.2
1 个基准族 · 3 个指标
frontiermath · frontier_math · z -0.03 · q 0.58
frontiermath · frontier_math_v2_tier4 · z 1.11 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.71 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#21
分数69.6
更新时间2026年9月13日
置信度4
FrontierMath (legacy)V3 计分证据
站内排名#5
分数51.7
更新时间2026年9月13日
置信度4
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#4
分数51.7
更新时间2026年9月13日
置信度4
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#7
分数35.4
更新时间2026年9月13日
置信度4

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

6 个指标 · 暂定评分

分数55.780% 区间39.6–71.81/4 实测维度Multimodal Grounded score71.3#24 / 56MMMU-Pro81.2#7 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理55.7
1 个基准族 · 1 个指标
mmmu_pro · mmmu_pro · z 0.69 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#24
分数71.3
更新时间2026年9月13日
置信度4
MMMU-ProV3 计分证据
站内排名#7
分数81.2
更新时间2026年9月13日
置信度4
MMMU-Pro w/ Python
站内排名#3
分数83.2
更新时间2026年9月13日
置信度4
OfficeQA Pro
站内排名#7
分数54.1
更新时间2026年9月13日
置信度4
AA-MMMU-Pro
站内排名#15
分数79.9
更新时间2026年9月13日
置信度4
Design Arena Website
站内排名#30
分数1269.0
更新时间2026年9月13日
置信度4

指令遵循

V3.0

2 个指标 · 暂定评分

分数54.880% 区间38.8–70.81/4 实测维度AA-IFBench75.9#13 / 84Instruction Following score93.2#5 / 52
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化54.8
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.35 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#13
分数75.9
更新时间2026年9月13日
置信度4
Instruction Following score
站内排名#5
分数93.2
更新时间2026年9月13日
置信度4

OpenRouter 端点

7 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
OpenAI
openai/flex
$2.50/M$15/M100%undefined tokens / undefined tokens
Azure
azure/eu
$5.50/M$33/M100%undefined tokens / undefined tokens
Azure
azure/us
$5.50/M$33/M100%undefined tokens / undefined tokens
OpenAI
openai/fast
$12.50/M$75/M100%undefined tokens / undefined tokens
OpenAI
openai
$5/M$30/M99.9%undefined tokens / undefined tokens
Azure
azure
$5/M$30/M99.8%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/us-east-1
$5.50/M$33/Mundefined tokens / undefined tokens

价格对比

对比 GPT-5.5 在 587 家服务商的 API 价格。价格从 $0.0089/M 到 $7425.00/M,其中 熊猫 API 提供最低价 $0.0089/M。 42 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
0%
gpt-5.5
default
$375.00/M
$2250.00/M
69.3 t/s
1.45 s
L1
0%
gpt-5.5-openai-compact
default
$25.00/M
Cache read$2.50/M
$150.00/M
L1
99%
gpt-5.5
default
$71.43/M
Cache read$7.14/M
$428.57/M
60.9 t/s
5.31 s
L1
100%
gpt-5.5
default
$68.49/M
Cache read$6.85/M
$410.96/M
58.9 t/s
3.86 s
L1
100%
gpt-5.5-openai-compact
default
$68.49/M
Cache read$6.85/M
$410.96/M
L1
100%
gpt-5.5
Azure-GPT
$15.00/M
Cache read$1.50/M
$90.00/M
52.4 t/s
2.73 s
L1
100%
gpt-5.5-openai-compact
codex-特惠活动
-70%$1.50/M
Cache read$0.150/M
-70%$9.00/M
L1
100%
gpt-5.5-2026-04-24
Azure-GPT
$15.00/M
$90.00/M
L1
100%
gpt-5.5
GPT-Entry
-97%$0.150/M
Cache read$0.015/M
-97%$0.900/M
52.0 t/s
3.05 s
L1
100%
gpt-5.5
Codex-Plus
-98%$0.115/M
Cache read$0.012/M
-98%$0.691/M
47.0 t/s
1.84 s
L1
100%
gpt-5.5
codex
-88%$0.600/M
Cache read$0.060/M
-88%$3.60/M
43.2 t/s
2.87 s
L1
100%
gpt-5.5-2026-04-23
gpt-azure
$5.00/M
$30.00/M
L1
100%
L2
100%
gpt-5.5
GTP Codex 全家桶
-97%$0.137/M
Cache read$0.014/MImage$2.739726e+22/M
-97%$0.822/M
39.1 t/s
3.40 s
L1
99%
gpt-5.5
临时渠道
-99%$0.068/M
Cache read$0.0068/M
-99%$0.411/M
38.4 t/s
8.94 s
L1
100%
gpt-5.5-2026-04-24
default
$5.00/M
$30.00/M
L1
100%
gpt-5.5
default
$5.00/M
$30.00/M
L1
100%
gpt-5.5
default
-93%$0.342/M
Cache read$0.034/M
-93%$2.05/M
L1
100%
gpt-5.5
GPT · 最佳现金等价值(条件优惠)
-95%$0.250/M
Cache read$0.025/M
-95%$1.50/M
L1
100%
gpt-5.5
azure-officially
-29%$3.57/M
Cache read$0.357/M
-29%$21.43/M
L1
100%
gpt-5.5
Codex-Plus
-99%$0.029/M
Cache read$0.0029/MCache write$0.037/MCache write 1h$0.059/M
-99%$0.176/M
当前显示 20 个模型 ID,共 206 个。

替代方案与相似模型

常见问题

GPT-5.5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-5.5 的基准测试、API 价格、输出速度、首字延迟和 629 家服务商数据。
GPT-5.5 API 价格是多少?
GPT-5.5 在 629 家服务商有价格记录,价格从 $0.0089/M$7425.00/M。最低价由 熊猫 API 提供。
GPT-5.5 API 价格表包含什么?
GPT-5.5 API 价格表会对比 629 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-5.5 API 价格最低?
熊猫 API 当前提供 GPT-5.5 的最低收录价格:$0.0089/M,共对比 629 家服务商。
可以同时对比 GPT-5.5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GPT-5.5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GPT-5.5 的 API 免费吗?
是的,GPT-5.5 免费 API 可通过 LMSpeed 上的 42 家服务商使用,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-5.5 免费 API?
LMSpeed 当前收录了 42 家 GPT-5.5 免费 API 服务商,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

11/gpt-5.515/gpt-5.5GPT-5.5[lq]q|XXQ/gpt-5.5[lq]t|CX/gpt-5.5

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档