OpenAI
·Released on 2025年11月13日

GPT-5.1 Codex API 基准测试 价格和服务商数据

选择与 GPT-5.1 Codex 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-5.1 Codex 页面汇总基准测试、API 价格和服务商数据,覆盖 379 家服务商,价格从 $0.0041/request 起。GPT-5.1 Codex 免费 API 额度来自 2 家服务商。

OpenAI 的 GPT-5.1 Codex是GPT-5.1 系列的代码专精模型,专为代码生成、调试与软件开发任务优化。

质量
0.0
LMSpeed 评分
成本
#120of 181
$0.0041/ 1M · 8:1 in:out
$0.0007 in · $0.0035 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体49.7代码50.6综合推理55.3知识50数学54.1多语言-多模态-指令遵循52.5
#1综合推理55.3正式评分全站排名 #163/4 实测维度
80% 区间: 46.764.0
abstract logic仅先验
scientific causal56.5
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints57.3
mmlu_pro · mmlu_pro
evidence verification52.2
lcr · lcr
#2数学54.1暂定评分1/4 实测维度
80% 区间: 38.070.3
foundational math54.1
aa_math_index · artificial_analysis_math_index
competition math仅先验
proof frontier仅先验
applied tool math仅先验
#3指令遵循52.5暂定评分1/4 实测维度
80% 区间: 36.568.5
constraint following仅先验
structured output仅先验
novel instruction generalization52.5
ifbench · aa_if_bench
long multiturn instruction仅先验
#4代码50.6估算2/4 实测维度
80% 区间: 39.461.8
code generation55.9
livecodebench · livecodebench / scicode · scicode
repository engineering45.3
vibecode · vibe_code_bench
debugging testing仅先验
tooling quality仅先验
#5知识50暂定评分1/4 实测维度
80% 区间: 34.066.0
broad knowledge50
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#6智能体49.7估算3/4 实测维度
80% 区间: 40.459.0
planning50.3
deep_planning · gert_labs
tool use49.9
tau · tau2_bench
environment execution仅先验
recovery reliability48.9
jobbench · job_bench
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
400Ktokens
480 pages of text
OUTPUT
128Ktokens
8K128K1M4M
400K

能力

Technical Details

输入
输出
发布日期
Nov 2025
官方文档
Tokenizer
GPT
架构
text+image->text
内容审核
支持参数
include_reasoningmax_completion_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

价格

2 个指标

输入价格$1.25/M#120 / 181输出价格$10.00/M#139 / 181
输入价格
Input price
站内排名#120
分数$1.25/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#139
分数$10.00/M
更新时间2026年9月1日
置信度4

智能体

V3.0

3 个指标 · 估算

分数49.780% 区间40.4–59.03/4 实测维度Τ²-bench results83.0#51 / 82Gert Labs49.7#23 / 49
维度与证据
规划拆解50.3
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.06 · q 1.00
工具调用49.9
1 个基准族 · 1 个指标
tau · tau2_bench · z -0.12 · q 1.00
环境与长程执行仅先验
恢复与完成可靠性48.9
1 个基准族 · 1 个指标
jobbench · job_bench · z -0.40 · q 1.00
Τ²-bench resultsV3 计分证据
站内排名#51
分数83.0
更新时间2026年8月14日
置信度1
Gert LabsV3 计分证据
站内排名#23
分数49.7
更新时间2026年8月14日
置信度1
JobBenchV3 计分证据
站内排名#14
分数26.2
更新时间2026年8月14日
置信度1

代码

V3.0

4 个指标 · 估算

分数50.680% 区间39.4–61.82/4 实测维度LiveCodeBench84.9%#9 / 115SciCode40.2%#84 / 206
维度与证据
代码生成55.9
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 1.17 · q 1.00
scicode · scicode · z 0.22 · q 1.00
仓库工程45.3
1 个基准族 · 1 个指标
vibecode · vibe_code_bench · z -0.62 · q 1.00
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#9
分数84.9%
更新时间2026年9月1日
置信度4
SciCodeV3 计分证据
站内排名#84
分数40.2%
更新时间2026年9月1日
置信度4
Vibe Code BenchV3 计分证据
站内排名#28
分数13.1
更新时间2026年8月14日
置信度1
AA-SciCodeV3 计分证据
站内排名#67
分数40.2
更新时间2026年8月14日
置信度1

综合推理

V3.0

5 个指标 · 正式评分

分数55.3#1680% 区间46.7–64.03/4 实测维度MMLU-Pro86.0%#23 / 129GPQA86.0%#57 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理56.5
3 个基准族 · 3 个指标
critpt · critpt · z 0.30 · q 1.00
gpqa · gpqa · z 0.58 · q 1.00
hle · hle · z 0.51 · q 1.00
多步约束57.3
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.77 · q 1.00
证据整合与验证52.2
1 个基准族 · 1 个指标
lcr · lcr · z -0.06 · q 1.00
MMLU-ProV3 计分证据
站内排名#23
分数86.0%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#57
分数86.0%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#64
分数25.7%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#55
分数69.0
更新时间2026年8月14日
置信度1
CritPtV3 计分证据
站内排名#38
分数5.7
更新时间2026年8月14日
置信度1

知识

V3.0

5 个指标 · 暂定评分

分数5080% 区间34.0–66.01/4 实测维度Artificial Analysis Intelligence Index35.6#57 / 111AA-GPQA Diamond86.0#49 / 108
维度与证据
广泛知识50
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -0.08 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#57
分数35.6
更新时间2026年8月14日
置信度1
AA-GPQA Diamond
站内排名#49
分数86.0
更新时间2026年8月14日
置信度1
AA-HLE
站内排名#54
分数25.7
更新时间2026年8月14日
置信度1
AA-Omniscience Accuracy
站内排名#32
分数39.9
更新时间2026年8月14日
置信度1
AA-Omniscience Hallucination Rate
站内排名#45
分数77.2
更新时间2026年8月14日
置信度1

数学

V3.0

0 个指标 · 暂定评分

分数54.180% 区间38.0–70.31/4 实测维度
维度与证据
基础数学54.1
1 个基准族 · 1 个指标
aa_math_index · artificial_analysis_math_index · z 0.95 · q 1.00
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

2 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度AA-MMMU-Pro72.5#43 / 65Design Arena Website1183.0#53 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
AA-MMMU-Pro
站内排名#43
分数72.5
更新时间2026年8月14日
置信度1
Design Arena Website
站内排名#53
分数1183.0
更新时间2026年8月14日
置信度1

指令遵循

V3.0

1 个指标 · 暂定评分

分数52.580% 区间36.5–68.51/4 实测维度AA-IFBench70.0#37 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化52.5
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.05 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#37
分数70.0
更新时间2026年8月14日
置信度1

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Azure
azure
$1.25/M$10/M100%undefined tokens / undefined tokens

价格对比

对比 GPT-5.1 Codex 在 377 家服务商的 API 价格。价格从 $0.0041/request 到 $495.00/M,其中 Yun API 提供最低价 $0.0041/request。 2 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
gpt-5.1-codex
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1-codex-high
CodeX_05_token
$0.0068/request
-
L1
100%
gpt-5.1-codex
default
$0.014/request
-
L1
100%
gpt-5.1-codex-medium
CodeX_05_token
$0.0068/request
-
L1
100%
gpt-5.1-codex-2025-11-13
default
-86%$0.171/M
-86%$1.37/M
L1
100%
gpt-5.1-codex
default
-86%$0.171/M
Cache read$0.017/M
-86%$1.37/M
L1
100%
gpt-5.1-codex
default
-23%$0.959/M
-23%$7.67/M
L1
100%
gpt-5.1-codex
default
$1.25/M
$10.00/M
L1
100%
gpt-5.1-codex-2025-11-13
default
$75.00/M
$600.00/M
兔子API
免费
L1
100%
gpt-5.1-codex
官方优惠
免费
免费
L1
100%
gpt-5.1-codex
gpt-azure
$1.25/M
-37%$6.25/M
L1
100%
gpt-5.1-codex-2025-11-13
gpt-azure
$1.25/M
Cache read$0.125/M
$10.00/M
L1
100%
gpt-5.1-codex
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1-codex
default
-96%$0.051/M
Cache read$0.0051/M
-96%$0.411/M
L1
100%
gpt-5.1-codex-2025-11-13
default
-96%$0.051/M
-96%$0.411/M
L1
100%
gpt-5.1-codex
official
$1.25/M
Cache read$0.125/M
$10.00/M
L1
99%
gpt-5.1-codex-2025-11-13
az
-79%$0.257/M
-79%$2.05/M
L1
99%
gpt-5.1-codex
az
-79%$0.257/M
Cache read$0.026/MCache write$0.321/MCache write 1h$0.514/M
-79%$2.05/M
L1
99%
gpt-5.1-codex-high
gpt-vip
-52%$0.599/M
Cache read$0.060/MCache write$0.749/MCache write 1h$1.20/M
-52%$4.79/M
L1
99%
gpt-5.1-codex-medium
gpt-vip
-52%$0.599/M
Cache read$0.060/MCache write$0.749/MCache write 1h$1.20/M
-52%$4.79/M
当前显示 20 个模型 ID,共 75 个。

替代方案与相似模型

常见问题

GPT-5.1 Codex 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-5.1 Codex 的基准测试、API 价格、输出速度、首字延迟和 379 家服务商数据。
GPT-5.1 Codex API 价格是多少?
GPT-5.1 Codex379 家服务商有价格记录,价格从 $0.0041/request $495.00/M。最低价由 Yun API 提供。
GPT-5.1 Codex API 价格表包含什么?
GPT-5.1 Codex API 价格表会对比 379 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-5.1 Codex API 价格最低?
Yun API 当前提供 GPT-5.1 Codex 的最低收录价格:$0.0041/request,共对比 379 家服务商。
GPT-5.1 Codex 的 API 免费吗?
是的,GPT-5.1 Codex 免费 API 可通过 LMSpeed 上的 2 家服务商使用,包括兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-5.1 Codex 免费 API?
LMSpeed 当前收录了 2 家 GPT-5.1 Codex 免费 API 服务商,包括兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

copilot/gpt-5.1-codexgpt-5-1-codexgpt-5.1-codexgpt-5.1-codex-2025-11-13gpt-5.1-codex-fast

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档