OpenAI
·Released on 2024年12月17日

O1 API 基准测试 价格和服务商数据

选择与 O1 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

O1 页面汇总基准测试、API 价格和服务商数据,覆盖 1018 家服务商,价格从 $0.033/request 起。O1 免费 API 额度来自 1 家服务商。

OpenAI 的 O1是语言模型,专为通用对话与文本生成任务优化。

质量
#33of 100
0.0
LMSpeed 评分
成本
#174of 181
$0.033/ 1M · 8:1 in:out
$0.0053 in · $0.028 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体45.6代码50.6综合推理50.7知识62.5数学52.6多语言-多模态-指令遵循51.5
#1知识62.5暂定评分1/4 实测维度
80% 区间: 45.079.9
broad knowledge62.5
mmlu · mmlu
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#2数学52.6估算3/4 实测维度
80% 区间: 43.361.9
foundational math53.1
math_500 · math_500
competition math56.9
aime · aime
proof frontier47.7
frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#3指令遵循51.5估算2/4 实测维度
80% 区间: 39.663.4
constraint following50.4
ifeval · ifeval
structured output仅先验
novel instruction generalization52.6
ifbench · aa_if_bench
long multiturn instruction仅先验
#4综合推理50.7正式评分全站排名 #393/4 实测维度
80% 区间: 42.159.4
abstract logic仅先验
scientific causal46.7
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints56
mmlu_pro · mmlu_pro
evidence verification49.6
lcr · lcr
#5代码50.6暂定评分1/4 实测维度
80% 区间: 36.764.5
code generation50.6
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
#6智能体45.6暂定评分1/4 实测维度
80% 区间: 29.561.6
planning仅先验
tool use45.6
tau · tau2_bench
environment execution仅先验
recovery reliability仅先验
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
200Ktokens
240 pages of text
OUTPUT
100Ktokens
8K128K1M4M
200K

能力

Technical Details

输入
输出
发布日期
Dec 2024
知识截止
2023-10-31
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_tokensreasoningresponse_formatseedstructured_outputstool_choicetools

排名

擅长

相对落后

详细分数

更新时间: 2026年9月1日

价格

2 个指标

输入价格$15.00/M#174 / 181输出价格$60.00/M#174 / 181
输入价格
Input price
站内排名#174
分数$15.00/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#174
分数$60.00/M
更新时间2026年9月1日
置信度4

智能体

V3.0

1 个指标 · 暂定评分

分数45.680% 区间29.5–61.61/4 实测维度Τ²-bench results62.6#61 / 82
维度与证据
规划拆解仅先验
工具调用45.6
1 个基准族 · 1 个指标
tau · tau2_bench · z -0.71 · q 1.00
环境与长程执行仅先验
恢复与完成可靠性仅先验
Τ²-bench resultsV3 计分证据
站内排名#61
分数62.6
更新时间2026年8月20日
置信度1

代码

V3.0

4 个指标 · 暂定评分

分数50.680% 区间36.7–64.51/4 实测维度LiveCodeBench67.9%#34 / 115SciCode35.8%#124 / 206
维度与证据
代码生成50.6
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 0.53 · q 1.00
scicode · scicode · z -0.19 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#34
分数67.9%
更新时间2026年9月1日
置信度4
SciCodeV3 计分证据
站内排名#124
分数35.8%
更新时间2026年9月1日
置信度4
AA Coding Index
站内排名#54
分数34.0
更新时间2026年8月20日
置信度1
AA-SciCodeV3 计分证据
站内排名#86
分数35.8
更新时间2026年8月20日
置信度1

综合推理

V3.0

5 个指标 · 正式评分

分数50.7#3980% 区间42.1–59.43/4 实测维度MMLU-Pro84.1%#34 / 129GPQA74.7%#120 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理46.7
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.03 · q 1.00
hle · hle · z -0.49 · q 1.00
多步约束56
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.59 · q 1.00
证据整合与验证49.6
1 个基准族 · 1 个指标
lcr · lcr · z -0.41 · q 1.00
MMLU-ProV3 计分证据
站内排名#34
分数84.1%
更新时间2026年9月1日
置信度4
GPQAV3 计分证据
站内排名#120
分数74.7%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#136
分数7.0%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#72
分数63.3
更新时间2026年8月20日
置信度1
CritPtV3 计分证据
站内排名#78
分数0.3
更新时间2026年8月20日
置信度1

知识

V3.0

7 个指标 · 暂定评分

分数62.580% 区间45.0–79.91/4 实测维度Artificial Analysis Intelligence Index17.2#90 / 111Knowledge score64.0#43 / 69
维度与证据
广泛知识62.5
1 个基准族 · 1 个指标
mmlu · mmlu · z 1.93 · q 0.21
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence Index
站内排名#90
分数17.2
更新时间2026年8月20日
置信度1
Knowledge score
站内排名#43
分数64.0
更新时间2026年8月20日
置信度1
MMLUV3 计分证据
站内排名#1
分数91.8
更新时间2026年8月20日
置信度1
AA-GPQA Diamond
站内排名#84
分数74.7
更新时间2026年8月20日
置信度1
AA-HLE
站内排名#85
分数7.0
更新时间2026年8月20日
置信度1
AA-Omniscience Accuracy
站内排名#43
分数34.5
更新时间2026年8月20日
置信度1
AA-Omniscience Hallucination Rate
站内排名#54
分数69.6
更新时间2026年8月20日
置信度1

数学

V3.0

4 个指标 · 估算

分数52.680% 区间43.3–61.93/4 实测维度AIME72.3%#19 / 68MATH-50097.0%#13 / 73
维度与证据
基础数学53.1
1 个基准族 · 1 个指标
math_500 · math_500 · z 0.44 · q 1.00
竞赛数学56.9
1 个基准族 · 1 个指标
aime · aime · z 0.90 · q 1.00
高阶证明47.7
1 个基准族 · 1 个指标
frontiermath · frontier_math_v2_tiers13 · z -0.65 · q 1.00
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#19
分数72.3%
更新时间2026年9月1日
置信度4
MATH-500V3 计分证据
站内排名#13
分数97.0%
更新时间2026年9月1日
置信度4
Math score
站内排名#48
分数32.6
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#34
分数9.3
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

3 个指标 · 估算

分数51.580% 区间39.6–63.42/4 实测维度Instruction Following score86.1#15 / 25IFEval92.2#10 / 16
维度与证据
约束遵循50.4
1 个基准族 · 1 个指标
ifeval · ifeval · z -0.15 · q 1.00
结构化输出仅先验
新指令泛化52.6
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.07 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#15
分数86.1
更新时间2026年8月20日
置信度1
IFEvalV3 计分证据
站内排名#10
分数92.2
更新时间2026年8月20日
置信度1
AA-IFBenchV3 计分证据
站内排名#35
分数70.3
更新时间2026年8月20日
置信度1

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
OpenAI
openai
$15/M$60/M100%undefined tokens / undefined tokens

价格对比

对比 O1 在 1017 家服务商的 API 价格。价格从 $0.033/request 到 $300.00/M,其中 柏拉图AI 提供最低价 $0.033/request。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
o1
default
-93%$1.03/M
Cache read$0.514/M
-93%$4.11/M
L1
100%
o1-2024-12-17
default
-93%$1.03/M
Cache read$0.514/M
-93%$4.11/M
L1
100%
o1-all
gf
$0.500/request
-
L1
100%
o1-2024-12-17
default
$15.00/M
$60.00/M
L1
100%
o1
default
$15.00/M
$60.00/M
L1
100%
o1-2024-12-17
default
-86%$2.05/M
Cache read$1.03/M
-86%$8.22/M
L1
100%
o1
default
-86%$2.05/M
Cache read$1.03/M
-86%$8.22/M
L1
100%
o1
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-2024-12-17
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-preview
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-preview-2024-09-12
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-preview-all
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-all
default
-86%$2.05/M
-86%$8.22/M
L1
100%
o1-preview-2024-09-12
default
-23%$11.51/M
-23%$46.03/M
L1
100%
o1
default
-23%$11.51/M
-23%$46.03/M
L1
100%
o1-2024-12-17
default
-23%$11.51/M
-23%$46.03/M
L1
100%
o1-preview
default
-23%$11.51/M
-23%$46.03/M
L1
100%
o1-2024-12-17
default
$15.00/M
Cache read$7.50/M
$60.00/M
L1
100%
o1
default
$15.00/M
Cache read$7.50/M
$60.00/M
兔子API
免费
L1
100%
o1-2024-12-17
原价分组
免费
免费
当前显示 20 个模型 ID,共 164 个。

替代方案与相似模型

常见问题

O1 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 O1 的基准测试、API 价格、输出速度、首字延迟和 1018 家服务商数据。
O1 API 价格是多少?
O11018 家服务商有价格记录,价格从 $0.033/request $300.00/M。最低价由 柏拉图AI 提供。
O1 API 价格表包含什么?
O1 API 价格表会对比 1018 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 O1 API 价格最低?
柏拉图AI 当前提供 O1 的最低收录价格:$0.033/request,共对比 1018 家服务商。
O1 的 API 免费吗?
是的,O1 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 O1 免费 API?
LMSpeed 当前收录了 1 家 O1 免费 API 服务商,包括兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

o1o1-2024-12-17o1-2024-12-17-higho1-2024-12-17-lowo1-2024-12-17-medium

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档