Anthropic

Claude Opus 4.7 Max API 基准测试 价格和服务商数据

选择与 Claude Opus 4.7 Max 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Claude Opus 4.7 Max 页面汇总基准测试、API 价格和服务商数据,覆盖 20 家服务商,价格从 $0.714/M 起。

Anthropic 的 Claude Opus 4.7 Max是Claude Opus 4.7 系列的旗舰大语言模型,专为高复杂度通用任务与多步推理优化。

质量
#22of 100
67.0
LMSpeed 评分
成本
$0.714/ 1M · 8:1 in:out
$0.114 in · $0.600 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体57.3代码60.8综合推理56.7知识61.8数学48.3多语言-多模态60.7指令遵循48.8
#1知识61.8暂定评分1/4 实测维度
80% 区间: 47.875.8
broad knowledge61.8
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#2代码60.8正式评分全站排名 #44/4 实测维度
80% 区间: 53.967.7
code generation62
scicode · aa_sci_code
repository engineering60.2
swe_pro · swe_pro
debugging testing70.4
swe_verified · swe_verified
tooling quality50.7
terminalbench · benchlm_coding_terminal_bench2
#3多模态60.7暂定评分1/4 实测维度
80% 区间: 44.576.8
perception ocr仅先验
document spatial60.7
charxiv · charxiv
visual reasoning仅先验
video action仅先验
#4智能体57.3正式评分全站排名 #153/4 实测维度
80% 区间: 49.665.0
planning仅先验
tool use55.8
mcp_atlas · mcp_atlas / tau · tau2_bench
environment execution58.8
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / itbench · aa_itbench / osworld · os_world2 / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability57.3
cyber_gym · cyber_gym / jobbench · job_bench
#5综合推理56.7正式评分全站排名 #113/4 实测维度
80% 区间: 47.965.4
abstract logic52.6
arc_agi · arc_agi2
scientific causal62
critpt · critpt / gpqa · aa_gpqa_diamond / hle · aa_hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification55.4
lcr · lcr
#6指令遵循48.8暂定评分1/4 实测维度
80% 区间: 32.864.8
constraint following仅先验
structured output仅先验
novel instruction generalization48.8
ifbench · aa_if_bench
long multiturn instruction仅先验
#7数学48.3暂定评分1/4 实测维度
80% 区间: 30.865.7
foundational math仅先验
competition math仅先验
proof frontier48.3
frontiermath · frontier_math
applied tool math仅先验
暂无数据:多语言

技术规格

Technical Details

官方文档

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月31日

综合

1 个指标

Overall score67.0#22 / 100
Overall score
站内排名#22
分数67.0
更新时间2026年8月31日
置信度3

智能体

V3.0

13 个指标 · 正式评分

分数57.3#1580% 区间49.6–65.03/4 实测维度Agentic score70.1#24 / 69Terminal-Bench 2.069.4#18 / 53
维度与证据
规划拆解仅先验
工具调用55.8
2 个基准族 · 2 个指标
mcp_atlas · mcp_atlas · z 0.39 · q 1.00
tau · tau2_bench · z 0.13 · q 1.00
环境与长程执行58.8
5 个基准族 · 6 个指标
browsecomp · browse_comp · z -0.09 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.93 · q 1.00
itbench · aa_itbench · z 0.09 · q 1.00
osworld · os_world2 · z 0.00 · q 1.00
osworld · os_world_verified · z 0.49 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.37 · q 1.00
恢复与完成可靠性57.3
2 个基准族 · 2 个指标
cyber_gym · cyber_gym · z -0.33 · q 1.00
jobbench · job_bench · z 0.78 · q 1.00
Agentic score
站内排名#24
分数70.1
更新时间2026年8月31日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#18
分数69.4
更新时间2026年8月31日
置信度3
BrowseCompV3 计分证据
站内排名#17
分数79.3
更新时间2026年8月31日
置信度3
MCP AtlasV3 计分证据
站内排名#7
分数77.3
更新时间2026年8月31日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#10
分数78.0
更新时间2026年8月31日
置信度3
CyberGymV3 计分证据
站内排名#9
分数73.1
更新时间2026年8月31日
置信度3
AA Agentic Index
站内排名#16
分数46.3
更新时间2026年8月31日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#38
分数88.6
更新时间2026年8月31日
置信度3
GDPval-AA
站内排名#18
分数49.1
更新时间2026年8月31日
置信度3
GDPval-AAV3 计分证据
站内排名#16
分数1483.0
更新时间2026年8月31日
置信度3
OSWorld 2.0V3 计分证据
站内排名#8
分数18.2
更新时间2026年8月31日
置信度3
JobBenchV3 计分证据
站内排名#4
分数45.9
更新时间2026年8月31日
置信度3
AA ITBenchV3 计分证据
站内排名#4
分数46.7
更新时间2026年8月31日
置信度3

代码

V3.0

6 个指标 · 正式评分

分数60.8#480% 区间53.9–67.74/4 实测维度Coding score63.9#7 / 81SWE-bench Verified87.6#4 / 49
维度与证据
代码生成62
1 个基准族 · 1 个指标
scicode · aa_sci_code · z 1.46 · q 1.00
仓库工程60.2
1 个基准族 · 1 个指标
swe_pro · swe_pro · z 1.42 · q 1.00
调试与测试70.4
1 个基准族 · 1 个指标
swe_verified · swe_verified · z 2.66 · q 1.00
工具化开发与质量50.7
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 0.09 · q 1.00
Coding score
站内排名#7
分数63.9
更新时间2026年8月31日
置信度3
SWE-bench VerifiedV3 计分证据
站内排名#4
分数87.6
更新时间2026年8月31日
置信度3
SWE-bench ProV3 计分证据
站内排名#7
分数64.3
更新时间2026年8月31日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#15
分数69.4
更新时间2026年8月31日
置信度3
AA Coding Index
站内排名#10
分数73.6
更新时间2026年8月31日
置信度3
AA-SciCodeV3 计分证据
站内排名#13
分数54.5
更新时间2026年8月31日
置信度3

综合推理

V3.0

8 个指标 · 正式评分

分数56.7#1180% 区间47.9–65.43/4 实测维度GPQA94.2%#3 / 212HLE54.7%#5 / 209
维度与证据
抽象逻辑52.6
1 个基准族 · 1 个指标
arc_agi · arc_agi2 · z 0.17 · q 1.00
科学与因果推理62
3 个基准族 · 4 个指标
critpt · critpt · z 0.64 · q 1.00
gpqa · aa_gpqa_diamond · z 1.09 · q 1.00
hle · aa_hle · z 1.00 · q 1.00
hle · hle_no_tools · z 0.59 · q 1.00
多步约束仅先验
证据整合与验证55.4
1 个基准族 · 1 个指标
lcr · lcr · z 0.36 · q 1.00
GPQAV3 计分证据
站内排名#3
分数94.2%
更新时间2026年8月31日
置信度3
HLEV3 计分证据
站内排名#5
分数54.7%
更新时间2026年8月31日
置信度3
Reasoning score
站内排名#13
分数71.4
更新时间2026年8月31日
置信度3
MRCR v2 128K-256K
站内排名#2
分数59.2
更新时间2026年8月31日
置信度3
ARC-AGI-2V3 计分证据
站内排名#7
分数75.8
更新时间2026年8月31日
置信度3
AA-LCRV3 计分证据
站内排名#25
分数75.3
更新时间2026年8月31日
置信度3
CritPtV3 计分证据
站内排名#26
分数12.0
更新时间2026年8月31日
置信度3
ARC-AGI-3
站内排名#9
分数0.2
更新时间2026年8月31日
置信度3

知识

V3.0

9 个指标 · 暂定评分

分数61.880% 区间47.8–75.81/4 实测维度Knowledge score81.8#13 / 69GPQA-D94.2#3 / 31
维度与证据
广泛知识61.8
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 1.06 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.97 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#13
分数81.8
更新时间2026年8月31日
置信度3
GPQA-D
站内排名#3
分数94.2
更新时间2026年8月31日
置信度3
HLE w/o tools
站内排名#4
分数46.9
更新时间2026年8月31日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#13
分数55.0
更新时间2026年8月31日
置信度3
AA-GPQA Diamond
站内排名#20
分数91.4
更新时间2026年8月31日
置信度3
AA-HLE
站内排名#18
分数42.3
更新时间2026年8月31日
置信度3
AA-Omniscience IndexV3 计分证据
站内排名#7
分数27.3
更新时间2026年8月31日
置信度3
AA-Omniscience Accuracy
站内排名#15
分数48.9
更新时间2026年8月31日
置信度3
AA-Omniscience Hallucination Rate
站内排名#80
分数42.3
更新时间2026年8月31日
置信度3

数学

V3.0

1 个指标 · 暂定评分

分数48.380% 区间30.8–65.71/4 实测维度FrontierMath (legacy)43.8#7 / 7
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明48.3
1 个基准族 · 1 个指标
frontiermath · frontier_math · z -0.31 · q 0.58
应用与工具辅助数学仅先验
FrontierMath (legacy)V3 计分证据
站内排名#7
分数43.8
更新时间2026年8月31日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

6 个指标 · 暂定评分

分数60.780% 区间44.5–76.81/4 实测维度Multimodal Grounded score46.0#34 / 44OfficeQA Pro43.6#9 / 9
维度与证据
感知与 OCR仅先验
文档与空间理解60.7
1 个基准族 · 1 个指标
charxiv · charxiv · z 1.54 · q 1.00
视觉推理仅先验
视频与落地行动仅先验
Multimodal Grounded score
站内排名#34
分数46.0
更新时间2026年8月31日
置信度3
OfficeQA Pro
站内排名#9
分数43.6
更新时间2026年8月31日
置信度3
CharXivV3 计分证据
站内排名#3
分数91.0
更新时间2026年8月31日
置信度3
CharXiv w/o tools
站内排名#5
分数82.1
更新时间2026年8月31日
置信度3
AA-MMMU-Pro
站内排名#16
分数78.8
更新时间2026年8月31日
置信度3
Design Arena Website
站内排名#9
分数1315.0
更新时间2026年8月31日
置信度3

指令遵循

V3.0

1 个指标 · 暂定评分

分数48.880% 区间32.8–64.81/4 实测维度AA-IFBench58.6#51 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化48.8
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -0.43 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#51
分数58.6
更新时间2026年8月31日
置信度3

价格对比

对比 Claude Opus 4.7 Max 在 20 家服务商的 API 价格。价格从 $0.714/M 到 $2600.00/M,其中 Gpt API 提供最低价 $0.714/M。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
claude-opus-4-7-max
claude_kiro
$1.75/M
$8.75/M
L1
100%
claude-opus-4-7-max
claude-reverse
$4.50/M
$22.50/M
L1
100%
[lq]u|RS/claude-opus-4-7-MAX
default
$2600.00/M
Cache read$260.00/MCache write$3250.00/MCache write 1h$5200.00/M
$13000.00/M
L1
99%
claude-opus-4-7-max
MAXCC
$147.60/M
$738.00/M
L1
100%
claude-opus-4-7-max
Claudecode-求稳分组
$6.00/M
$30.00/M
L1
70%
claude-opus-4-7-max
claude_kiro
$1.75/M
$8.75/M
L1
100%
claude-opus-4-7-max
default
$0.714/M
$3.57/M
L1
99%
claude-opus-4-7-max
default
$40.00/M
Cache read$4.00/MCache write$50.00/MCache write 1h$80.00/M
$200.00/M

替代方案与相似模型

常见问题

Claude Opus 4.7 Max 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Claude Opus 4.7 Max 的基准测试、API 价格、输出速度、首字延迟和 20 家服务商数据。
Claude Opus 4.7 Max API 价格是多少?
Claude Opus 4.7 Max20 家服务商有价格记录,价格从 $0.714/M $2600.00/M。最低价由 Gpt API 提供。
Claude Opus 4.7 Max API 价格表包含什么?
Claude Opus 4.7 Max API 价格表会对比 20 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Claude Opus 4.7 Max API 价格最低?
Gpt API 当前提供 Claude Opus 4.7 Max 的最低收录价格:$0.714/M,共对比 20 家服务商。
Claude Opus 4.7 Max 的 API 免费吗?
Claude Opus 4.7 Max 目前在 LMSpeed 上没有免费 API 方案,20 家服务商均按 token 计费。

别名

[lq]u|RS/claude-opus-4-7-MAXclaude-opus-4-7-maxclaude-opus-4.7-max

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档