OpenAI
·Released on 2026年9月4日

GPT-6 Astra API 基准测试 价格和服务商数据

选择与 GPT-6 Astra 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

GPT-6 Astra 页面汇总基准测试、API 价格和服务商数据,覆盖 4 家服务商,价格从 $3.80/M 起。

GPT-6 Astra is OpenAI's flagship model for demanding end-to-end work. It is suited for advanced analysis, software engineering, deep research, scientific work, and document creation, with particular s...

质量
#2of 110
81.0
LMSpeed 评分
成本
#174of 185
$3.80/ 1M · 8:1 in:out
$0.608 in · $3.19 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体62.9代码58.9综合推理61.5知识58数学72.3多语言-多模态66.4指令遵循-
#1数学72.3暂定评分1/4 实测维度
80% 区间: 56.288.5
foundational math仅先验
competition math仅先验
proof frontier72.3
frontiermath · frontier_math_v2_tier4
applied tool math仅先验
#2多模态66.4暂定评分1/4 实测维度
80% 区间: 50.182.8
perception ocr仅先验
document spatial仅先验
visual reasoning仅先验
video action66.4
screenspot · screen_spot_pro
#3智能体62.9正式评分全站排名 #63/4 实测维度
80% 区间: 54.671.3
planning仅先验
tool use55
tau · aa_tau3_banking
environment execution67.3
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / osworld · os_world2
recovery reliability66.6
briefcase · aa_briefcase_elo / exploit_gym · exploit_gym
#4综合推理61.5正式评分全站排名 #13/4 实测维度
80% 区间: 52.870.2
abstract logic62.9
arc_agi · arc_agi2
scientific causal67
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification54.6
lcr · lcr
#5代码58.9估算2/4 实测维度
80% 区间: 47.070.8
code generation59.4
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality58.4
terminalbench · aa_terminal_bench21
#6知识58暂定评分1/4 实测维度
80% 区间: 41.474.6
broad knowledge仅先验
professional knowledge58
healthbench · health_bench_hard
factuality仅先验
retrieval open book仅先验
暂无数据:多语言指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.1Mtokens
1.3K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1.1M

能力

Technical Details

输入
输出
发布日期
Sep 2026
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月5日

综合

13 个指标

Overall score81.0#2 / 110DeepSWE74.1#2 / 21
Overall score
站内排名#2
分数81.0
更新时间2026年9月5日
置信度3
DeepSWE
站内排名#2
分数74.1
更新时间2026年9月5日
置信度3
ExploitBench
站内排名#1
分数100.0
更新时间2026年9月5日
置信度3
SRE-Bench
站内排名#1
分数88.0
更新时间2026年9月5日
置信度3
FrontierCyber
站内排名#1
分数38.1
更新时间2026年9月5日
置信度3
CyScenarioBench success
站内排名#1
分数59.0
更新时间2026年9月5日
置信度3
CyScenarioBench solved
站内排名#1
分数9.0
更新时间2026年9月5日
置信度3
Atomic network attacks
站内排名#1
分数100.0
更新时间2026年9月5日
置信度3
Atomic vulnerability research
站内排名#1
分数100.0
更新时间2026年9月5日
置信度3
Atomic evasion
站内排名#3
分数52.0
更新时间2026年9月5日
置信度3
ACCR standard
站内排名#1
分数3.5
更新时间2026年9月5日
置信度3
ACCR Daybreak Blue
站内排名#1
分数3.5
更新时间2026年9月5日
置信度3
SEC-Bench Pro
站内排名#1
分数85.4
更新时间2026年9月5日
置信度3

价格

2 个指标

输入价格$10.00/M#174 / 185输出价格$50.00/M#175 / 185
输入价格
Input price
站内排名#174
分数$10.00/M
更新时间2026年9月5日
置信度4
输出价格
Output price
站内排名#175
分数$50.00/M
更新时间2026年9月5日
置信度4

智能体

V3.0

15 个指标 · 正式评分

分数62.9#680% 区间54.6–71.33/4 实测维度Agentic score87.1#5 / 76OSWorld 2.072.6#1 / 19
维度与证据
规划拆解仅先验
工具调用55
1 个基准族 · 1 个指标
tau · aa_tau3_banking · z 0.16 · q 1.00
环境与长程执行67.3
3 个基准族 · 3 个指标
browsecomp · browse_comp · z 1.24 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 1.06 · q 1.00
osworld · os_world2 · z 1.53 · q 1.00
恢复与完成可靠性66.6
2 个基准族 · 2 个指标
briefcase · aa_briefcase_elo · z 0.58 · q 1.00
exploit_gym · exploit_gym · z 1.49 · q 0.58
Agentic score
站内排名#5
分数87.1
更新时间2026年9月5日
置信度3
OSWorld 2.0V3 计分证据
站内排名#1
分数72.6
更新时间2026年9月5日
置信度3
Terminal-Bench 4.0
站内排名#1
分数57.9
更新时间2026年9月5日
置信度3
Terminal-Bench-Science 0.1
站内排名#1
分数64.6
更新时间2026年9月5日
置信度3
ExploitGymV3 计分证据
站内排名#1
分数42.4
更新时间2026年9月5日
置信度3
Agents' Last Exam
站内排名#1
分数59.3
更新时间2026年9月5日
置信度3
AA Agentic Index
站内排名#9
分数51.5
更新时间2026年9月5日
置信度3
GDPval-AA
站内排名#9
分数56.5
更新时间2026年9月5日
置信度3
GDPval-AAV3 计分证据
站内排名#11
分数1629.0
更新时间2026年9月5日
置信度3
AA BriefcaseV3 计分证据
站内排名#3
分数1569.0
更新时间2026年9月5日
置信度3
AA Tau3 BankingV3 计分证据
站内排名#10
分数41.4
更新时间2026年9月5日
置信度3
BrowseCompV3 计分证据
站内排名#2
分数91.5
更新时间2026年9月5日
置信度3
AutomationBench
站内排名#3
分数41.4
更新时间2026年9月5日
置信度3
HLE w/ tools
站内排名#4
分数57.2
更新时间2026年9月5日
置信度3
Terminal-Bench 2.1 (Vals)
站内排名#1
分数87.3
更新时间2026年9月5日
置信度3

代码

V3.0

7 个指标 · 估算

分数58.980% 区间47.0–70.82/4 实测维度SciCode53.5%#16 / 37AA Terminal-Bench 2.188.4#3 / 22
维度与证据
代码生成59.4
1 个基准族 · 1 个指标
scicode · scicode · z 1.10 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量58.4
1 个基准族 · 1 个指标
terminalbench · aa_terminal_bench21 · z 0.62 · q 1.00
SciCodeV3 计分证据
站内排名#16
分数53.5%
更新时间2026年9月5日
置信度4
AA Terminal-Bench 2.1V3 计分证据
站内排名#3
分数88.4
更新时间2026年9月5日
置信度3
AA Coding Index
站内排名#4
分数76.9
更新时间2026年9月5日
置信度3
AA-SciCodeV3 计分证据
站内排名#16
分数54.1
更新时间2026年9月5日
置信度3
Coding score
站内排名#4
分数78.5
更新时间2026年9月5日
置信度3
FrontierCode 1.1 Main
站内排名#3
分数53.3
更新时间2026年9月5日
置信度3
FrontierCode 1.1 Extended
站内排名#1
分数64.5
更新时间2026年9月5日
置信度3

综合推理

V3.0

11 个指标 · 正式评分

分数61.5#180% 区间52.8–70.23/4 实测维度GPQA89.5%#40 / 217HLE37.1%#36 / 214
维度与证据
抽象逻辑62.9
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z 1.63 · q 1.00
科学与因果推理67
3 个基准族 · 3 个指标
critpt · critpt · z 1.03 · q 1.00
gpqa · gpqa · z 1.87 · q 1.00
hle · hle · z 1.28 · q 1.00
多步约束仅先验
证据整合与验证54.6
1 个基准族 · 1 个指标
lcr · lcr · z 0.18 · q 1.00
GPQAV3 计分证据
站内排名#40
分数89.5%
更新时间2026年9月5日
置信度4
HLEV3 计分证据
站内排名#36
分数37.1%
更新时间2026年9月5日
置信度4
Reasoning score
站内排名#1
分数88.8
更新时间2026年9月5日
置信度3
ARC-AGI-2V3 计分证据
站内排名#1
分数95.0
更新时间2026年9月5日
置信度3
ARC-AGI-3
站内排名#1
分数62.7
更新时间2026年9月5日
置信度3
MRCR v2 256K-512K
站内排名#1
分数100.0
更新时间2026年9月5日
置信度3
MRCR v2 512K-1M
站内排名#2
分数96.3
更新时间2026年9月5日
置信度3
AA-LCRV3 计分证据
站内排名#38
分数74.3
更新时间2026年9月5日
置信度3
CritPtV3 计分证据
站内排名#2
分数31.7
更新时间2026年9月5日
置信度3
ARC-AGI-1
站内排名#1
分数98.5
更新时间2026年9月5日
置信度3
GeneBench-Pro
站内排名#1
分数37.8
更新时间2026年9月5日
置信度3

知识

V3.0

10 个指标 · 暂定评分

分数5880% 区间41.4–74.61/4 实测维度Knowledge score86.8#5 / 82GPQA-D96.0#1 / 32
维度与证据
广泛知识仅先验
专业知识58
1 个基准族 · 1 个指标
healthbench · health_bench_hard · z 0.35 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#5
分数86.8
更新时间2026年9月5日
置信度3
GPQA-D
站内排名#1
分数96.0
更新时间2026年9月5日
置信度3
HealthBench Professional
站内排名#1
分数63.4
更新时间2026年9月5日
置信度3
HealthBench HardV3 计分证据
站内排名#2
分数36.3
更新时间2026年9月5日
置信度3
Artificial Analysis Intelligence Index
站内排名#5
分数61.2
更新时间2026年9月5日
置信度3
AA-GPQA Diamond
站内排名#1
分数96.1
更新时间2026年9月5日
置信度3
AA-HLE
站内排名#4
分数54.7
更新时间2026年9月5日
置信度3
AA-Omniscience Index
站内排名#2
分数43.4
更新时间2026年9月5日
置信度3
AA-Omniscience Accuracy
站内排名#3
分数62.6
更新时间2026年9月5日
置信度3
AA-Omniscience Hallucination Rate
站内排名#75
分数51.3
更新时间2026年9月5日
置信度3

数学

V3.0

2 个指标 · 暂定评分

分数72.380% 区间56.2–88.51/4 实测维度Math score85.2#4 / 63FrontierMath v2 (Tier 4)97.6#1 / 36
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明72.3
1 个基准族 · 1 个指标
frontiermath · frontier_math_v2_tier4 · z 3.00 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#4
分数85.2
更新时间2026年9月5日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#1
分数97.6
更新时间2026年9月5日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

4 个指标 · 暂定评分

分数66.480% 区间50.1–82.81/4 实测维度ScreenSpot Pro92.7#1 / 12AA-MMMU-Pro86.9#1 / 68
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动66.4
1 个基准族 · 1 个指标
screenspot · screen_spot_pro · z 1.85 · q 1.00
ScreenSpot ProV3 计分证据
站内排名#1
分数92.7
更新时间2026年9月5日
置信度3
AA-MMMU-Pro
站内排名#1
分数86.9
更新时间2026年9月5日
置信度3
Multimodal Grounded score
站内排名#8
分数82.6
更新时间2026年9月5日
置信度3
BenchCAD Vision2Code (tools)
站内排名#1
分数1.0
更新时间2026年9月5日
置信度3

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

价格对比

对比 GPT-6 Astra 在 4 家服务商的 API 价格。价格从 $3.80/M 到 $9.80/M,其中 无限智能 提供最低价 $3.80/M。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
gpt-6-astra
GPT-PLUS稳定🐢-x0.38-对话 · ≤272K
-62%$3.80/M
Cache read$0.380/MCache write$4.75/M
-62%$19.00/M

替代方案与相似模型

常见问题

GPT-6 Astra 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 GPT-6 Astra 的基准测试、API 价格、输出速度、首字延迟和 4 家服务商数据。
GPT-6 Astra API 价格是多少?
GPT-6 Astra4 家服务商有价格记录,价格从 $3.80/M $9.80/M。最低价由 无限智能 提供。
GPT-6 Astra API 价格表包含什么?
GPT-6 Astra API 价格表会对比 4 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 GPT-6 Astra API 价格最低?
无限智能 当前提供 GPT-6 Astra 的最低收录价格:$3.80/M,共对比 4 家服务商。
GPT-6 Astra 的 API 免费吗?
GPT-6 Astra 目前在 LMSpeed 上没有免费 API 方案,4 家服务商均按 token 计费。

别名

gpt-6-astraopenai/gpt-6-astraopenai/gpt-6-astra:batch

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档