OpenAI
·Released on 2026年7月9日

GPT-5.6 Luna API 基准测试 价格和服务商数据

选择与 GPT-5.6 Luna 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-5.6 Luna 页面汇总基准测试、API 价格和服务商数据,覆盖 674 家服务商,价格从 $0.0016/M 起。GPT-5.6 Luna 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providin...

质量
#19of 100
70.0
LMSpeed 评分
速度
#26of 74
654char/s
6.86 s
成本
#33of 180
$0.0016/ 1M · 8:1 in:out
$0.0003 in · $0.0013 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体58.3代码56.7综合推理54.5知识56.5数学62.4多语言-多模态50.3指令遵循-
#1数学62.4暂定评分1/4 实测维度
80% 区间: 46.378.5
foundational math仅先验
competition math仅先验
proof frontier62.4
frontiermath · frontier_math / frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#2智能体58.3正式评分全站排名 #123/4 实测维度
80% 区间: 50.965.7
planning仅先验
tool use54.1
tau · aa_tau3_banking / toolathlon · toolathlon
environment execution62.3
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / itbench · aa_itbench / osworld · os_world2 / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability58.5
apex_agents · apex_agents_aa / cyber_gym · cyber_gym / exploit_gym · exploit_gym / harvey_lab · aa_harvey_lab
#3代码56.7估算3/4 实测维度
80% 区间: 47.566.0
code generation56.4
scicode · scicode
repository engineering57.8
swe_pro · swe_pro
debugging testing仅先验
tooling quality55.9
terminalbench · aa_terminal_bench21 / terminalbench · benchlm_coding_terminal_bench2
#4知识56.5暂定评分1/4 实测维度
80% 区间: 39.873.1
broad knowledge仅先验
professional knowledge56.5
healthbench · health_bench_hard
factuality仅先验
retrieval open book仅先验
#5综合推理54.5正式评分全站排名 #183/4 实测维度
80% 区间: 45.763.2
abstract logic47.5
arc_agi · arc_agi2
scientific causal58.8
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification57.1
lcr · lcr
#6多模态50.3暂定评分1/4 实测维度
80% 区间: 34.266.4
perception ocr仅先验
document spatial仅先验
visual reasoning50.3
mmmu_pro · mmmu_pro
video action仅先验
暂无数据:多语言指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.1Mtokens
1.3K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1.1M

能力

Technical Details

输入
输出
发布日期
Jul 2026
知识截止
2026-02-16
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

相对落后

详细分数

更新时间: 2026年8月24日

综合

3 个指标

Overall score70.0#19 / 100DeepSWE67.2#5 / 16
Overall score
站内排名#19
分数70.0
更新时间2026年8月24日
置信度3
DeepSWE
站内排名#5
分数67.2
更新时间2026年8月24日
置信度3
ExploitBench
站内排名#3
分数33.2
更新时间2026年8月24日
置信度3

速度与延迟

2 个指标

输出速度132.4 tok/s#26 / 74首字延迟86.96 s#73 / 74
输出速度
Output speed
站内排名#26
分数132.4 tok/s
更新时间2026年8月24日
置信度4
首字延迟
Time to first token
站内排名#73
分数86.96 s
更新时间2026年8月24日
置信度4

价格

2 个指标

输入价格$0.200/M#33 / 180输出价格$1.20/M#49 / 180
输入价格
Input price
站内排名#33
分数$0.200/M
更新时间2026年8月24日
置信度4
输出价格
Output price
站内排名#49
分数$1.20/M
更新时间2026年8月24日
置信度4

智能体

V3.0

16 个指标 · 正式评分

分数58.3#1280% 区间50.9–65.73/4 实测维度Agentic score85.0#8 / 69Terminal-Bench 2.084.7#4 / 53
维度与证据
规划拆解仅先验
工具调用54.1
2 个基准族 · 2 个指标
tau · aa_tau3_banking · z -0.43 · q 1.00
toolathlon · toolathlon · z 0.55 · q 1.00
环境与长程执行62.3
5 个基准族 · 5 个指标
browsecomp · browse_comp · z 0.27 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 1.21 · q 1.00
itbench · aa_itbench · z -1.26 · q 1.00
osworld · os_world2 · z 0.89 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 1.68 · q 1.00
恢复与完成可靠性58.5
4 个基准族 · 4 个指标
apex_agents · apex_agents_aa · z 0.65 · q 1.00
cyber_gym · cyber_gym · z 0.12 · q 1.00
exploit_gym · exploit_gym · z -0.05 · q 0.50
harvey_lab · aa_harvey_lab · z -0.35 · q 1.00
Agentic score
站内排名#8
分数85.0
更新时间2026年8月24日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#4
分数84.7
更新时间2026年8月24日
置信度3
BrowseCompV3 计分证据
站内排名#13
分数83.3
更新时间2026年8月24日
置信度3
OSWorld 2.0V3 计分证据
站内排名#5
分数45.6
更新时间2026年8月24日
置信度3
CyberGymV3 计分证据
站内排名#7
分数77.9
更新时间2026年8月24日
置信度3
ExploitGymV3 计分证据
站内排名#4
分数12.4
更新时间2026年8月24日
置信度3
ToolathlonV3 计分证据
站内排名#7
分数53.4
更新时间2026年8月24日
置信度3
AA Agentic Index
站内排名#15
分数46.9
更新时间2026年8月24日
置信度3
GDPval-AA
站内排名#11
分数53.9
更新时间2026年8月24日
置信度3
GDPval-AAV3 计分证据
站内排名#11
分数1582.0
更新时间2026年8月24日
置信度3
AA Harvey LABV3 计分证据
站内排名#9
分数87.9
更新时间2026年8月24日
置信度3
AA ITBenchV3 计分证据
站内排名#7
分数40.3
更新时间2026年8月24日
置信度3
AA Tau3 BankingV3 计分证据
站内排名#11
分数31.1
更新时间2026年8月24日
置信度3
AA AutomationBench
站内排名#11
分数42.2
更新时间2026年8月24日
置信度3
APEX-Agents-AAV3 计分证据
站内排名#5
分数35.8
更新时间2026年8月24日
置信度3
Terminal-Bench 3.0
站内排名#10
分数14.3
更新时间2026年8月24日
置信度3

代码

V3.0

9 个指标 · 估算

分数56.780% 区间47.5–66.03/4 实测维度SciCode52.5%#21 / 204Coding score57.5#37 / 81
维度与证据
代码生成56.4
1 个基准族 · 1 个指标
scicode · scicode · z 0.70 · q 1.00
仓库工程57.8
1 个基准族 · 1 个指标
swe_pro · swe_pro · z 1.10 · q 1.00
调试与测试仅先验
工具化开发与质量55.9
1 个基准族 · 2 个指标
terminalbench · aa_terminal_bench21 · z 0.06 · q 1.00
terminalbench · benchlm_coding_terminal_bench2 · z 1.29 · q 1.00
SciCodeV3 计分证据
站内排名#21
分数52.5%
更新时间2026年8月24日
置信度4
Coding score
站内排名#37
分数57.5
更新时间2026年8月24日
置信度3
SWE-bench ProV3 计分证据
站内排名#10
分数62.7
更新时间2026年8月24日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#3
分数84.7
更新时间2026年8月24日
置信度3
FrontierCode 1.1 Extended
站内排名#5
分数55.1
更新时间2026年8月24日
置信度3
CursorBench v3.2
站内排名#9
分数61.1
更新时间2026年8月24日
置信度3
AA Coding Index
站内排名#15
分数71.5
更新时间2026年8月24日
置信度3
AA-SciCodeV3 计分证据
站内排名#24
分数52.5
更新时间2026年8月24日
置信度3
AA Terminal-Bench 2.1V3 计分证据
站内排名#8
分数80.9
更新时间2026年8月24日
置信度3

综合推理

V3.0

7 个指标 · 正式评分

分数54.5#1880% 区间45.7–63.23/4 实测维度GPQA91.1%#21 / 211HLE39.5%#27 / 208
维度与证据
抽象逻辑47.5
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z -0.51 · q 1.00
科学与因果推理58.8
3 个基准族 · 3 个指标
critpt · critpt · z 0.90 · q 1.00
gpqa · gpqa · z 0.57 · q 1.00
hle · hle · z 0.51 · q 1.00
多步约束仅先验
证据整合与验证57.1
1 个基准族 · 1 个指标
lcr · lcr · z 0.59 · q 1.00
GPQAV3 计分证据
站内排名#21
分数91.1%
更新时间2026年8月24日
置信度4
HLEV3 计分证据
站内排名#27
分数39.5%
更新时间2026年8月24日
置信度4
ARC-AGI-3
站内排名#9
分数0.2
更新时间2026年8月24日
置信度3
AA-LCRV3 计分证据
站内排名#13
分数78.3
更新时间2026年8月24日
置信度3
CritPtV3 计分证据
站内排名#12
分数20.6
更新时间2026年8月24日
置信度3
Reasoning score
站内排名#23
分数57.8
更新时间2026年8月24日
置信度3
ARC-AGI-2V3 计分证据
站内排名#11
分数59.5
更新时间2026年8月24日
置信度3

知识

V3.0

9 个指标 · 暂定评分

分数56.580% 区间39.8–73.11/4 实测维度Knowledge score81.5#14 / 69GPQA-D92.3#12 / 31
维度与证据
广泛知识仅先验
专业知识56.5
1 个基准族 · 1 个指标
healthbench · health_bench_hard · z 0.00 · q 0.88
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#14
分数81.5
更新时间2026年8月24日
置信度3
GPQA-D
站内排名#12
分数92.3
更新时间2026年8月24日
置信度3
HealthBench Professional
站内排名#5
分数55.7
更新时间2026年8月24日
置信度3
HealthBench HardV3 计分证据
站内排名#4
分数32.0
更新时间2026年8月24日
置信度3
Artificial Analysis Intelligence Index
站内排名#21
分数51.2
更新时间2026年8月24日
置信度3
AA-GPQA Diamond
站内排名#21
分数91.1
更新时间2026年8月24日
置信度3
AA-HLE
站内排名#25
分数39.5
更新时间2026年8月24日
置信度3
AA-Omniscience Accuracy
站内排名#25
分数42.7
更新时间2026年8月24日
置信度3
AA-Omniscience Hallucination Rate
站内排名#10
分数92.6
更新时间2026年8月24日
置信度3

数学

V3.0

4 个指标 · 暂定评分

分数62.480% 区间46.3–78.51/4 实测维度Math score96.9#1 / 62FrontierMath (legacy)78.6#3 / 7
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明62.4
1 个基准族 · 3 个指标
frontiermath · frontier_math · z 1.10 · q 0.58
frontiermath · frontier_math_v2_tier4 · z 1.73 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 1.42 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#1
分数96.9
更新时间2026年8月24日
置信度3
FrontierMath (legacy)V3 计分证据
站内排名#3
分数78.6
更新时间2026年8月24日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#3
分数78.6
更新时间2026年8月24日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#3
分数58.5
更新时间2026年8月24日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

4 个指标 · 暂定评分

分数50.380% 区间34.2–66.41/4 实测维度Multimodal Grounded score66.0#24 / 44MMMU-Pro78.4#17 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理50.3
1 个基准族 · 1 个指标
mmmu_pro · mmmu_pro · z -0.02 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#24
分数66.0
更新时间2026年8月24日
置信度3
MMMU-ProV3 计分证据
站内排名#17
分数78.4
更新时间2026年8月24日
置信度3
MMMU-Pro w/ Python
站内排名#7
分数79.5
更新时间2026年8月24日
置信度3
AA-MMMU-Pro
站内排名#17
分数78.6
更新时间2026年8月24日
置信度3

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

7 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Amazon Bedrock
amazon-bedrock/us-east-1
$0.220/M$1.32/M100%undefined tokens / undefined tokens
Azure
azure/eu
$0.220/M$1.32/M100.0%undefined tokens / undefined tokens
OpenAI
openai/flex
$0.100/M$0.600/M98.9%undefined tokens / undefined tokens
OpenAI
openai
$0.200/M$1.20/M98.9%undefined tokens / undefined tokens
OpenAI
openai/priority
$0.400/M$2.40/M98.9%undefined tokens / undefined tokens
Azure
azure
$0.200/M$1.20/M94.6%undefined tokens / undefined tokens
Azure
azure/us
$0.220/M$1.32/M89.7%undefined tokens / undefined tokens

价格对比

对比 GPT-5.6 Luna 在 669 家服务商的 API 价格。价格从 $0.0016/M 到 $6993.00/M,其中 熊猫 API 提供最低价 $0.0016/M。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
gpt-5.6-luna
default
$0.029/request
-
150.9 t/s+14%
3.07 s-96%
L1
100%
gpt-5.6-luna
Codex
$0.250/M
Cache read$0.025/MCache write$0.313/MCache write 1h$0.500/M
$1.50/M
40.0 t/s
13.90 s-84%
L1
100%
gpt-5.6-luna
codex
-64%$0.071/M
Cache read$0.0071/M
-64%$0.429/M
L1
100%
gpt-5.6-luna
default
-66%$0.068/M
Cache read$0.0068/M
-66%$0.411/M
L1
99%
gpt-5.6-luna
default
$1.00/M
$6.00/M
L1
99%
gpt-5.6-luna
Codex-Plus
-97%$0.0059/M
Cache read$0.0006/M
-96%$0.047/M
L1
100%
gpt-5.6-luna
GPT-Entry
-85%$0.030/M
Cache read$0.0030/M
-85%$0.180/M
L1
100%
gpt-5.6-luna
default
-32%$0.137/M
-32%$0.822/M
L1
100%
gpt-5.6-luna-medium
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-high
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-high-openai-compact
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-low
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-low-openai-compact
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-medium-openai-compact
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-openai-compact
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-xhigh
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-xhigh-openai-compact
CodeX_05_token
-66%$0.068/M
-66%$0.411/M
L1
100%
gpt-5.6-luna-2026-07-09
default
-32%$0.137/M
-32%$0.822/M
L1
100%
gpt-5.6-luna
discount-codex
-75%$0.050/M
Cache read$0.0050/MCache write$0.063/MCache write 1h$0.100/M
-75%$0.300/M
L1
100%
gpt-5.6-luna
gpt-精品-个人版
-48%$0.103/M
-31%$0.827/M
当前显示 20 个模型 ID,共 173 个。

替代方案与相似模型

常见问题

GPT-5.6 Luna 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-5.6 Luna 的基准测试、API 价格、输出速度、首字延迟和 674 家服务商数据。
GPT-5.6 Luna API 价格是多少?
GPT-5.6 Luna674 家服务商有价格记录,价格从 $0.0016/M $6993.00/M。最低价由 熊猫 API 提供。
GPT-5.6 Luna API 价格表包含什么?
GPT-5.6 Luna API 价格表会对比 674 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-5.6 Luna API 价格最低?
熊猫 API 当前提供 GPT-5.6 Luna 的最低收录价格:$0.0016/M,共对比 674 家服务商。
可以同时对比 GPT-5.6 Luna API 价格和速度吗?
可以。LMSpeed 会在同一页展示 GPT-5.6 Luna API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
GPT-5.6 Luna 的 API 免费吗?
是的,GPT-5.6 Luna 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括兔子API, Moyanjdc API, APIMart, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 GPT-5.6 Luna 免费 API?
LMSpeed 当前收录了 5 家 GPT-5.6 Luna 免费 API 服务商,包括兔子API, Moyanjdc API, APIMart, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

[lq]q|XXQ/gpt-5.6-lunagpt-5-6-lunagpt-5.6-lunagpt-5.6-luna-2026-07-09gpt-5.6-luna-high

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档