Anthropic
·Released on 2025年11月24日

Claude Opus 4.5 API 基准测试 价格和服务商数据

选择与 Claude Opus 4.5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Claude Opus 4.5 页面汇总基准测试、API 价格和服务商数据,覆盖 573 家服务商,价格从 $0.0068/request 起。Claude Opus 4.5 免费 API 额度来自 6 家服务商。页面同时展示实测速度和首字延迟。

Anthropic 的 Claude Opus 4.5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。

质量
#57of 100
54.0
LMSpeed 评分
速度
54char/s
3.12 s
成本
#164of 180
$0.0068/ 1M · 8:1 in:out
$0.0011 in · $0.0058 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
8 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体48.6代码55.7综合推理60.7知识57.6数学49.9多语言51.7多模态32.4指令遵循45.7
#1综合推理60.7正式评分全站排名 #33/4 实测维度
80% 区间: 52.568.8
abstract logic仅先验
scientific causal53.4
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints61.7
mmlu_pro · mmlu_pro
evidence verification67
ai_needle · ai_needle / lcr · lcr / longbench · long_bench_v2
#2知识57.6估算2/4 实测维度
80% 区间: 45.969.2
broad knowledge65.7
c_eval · c_eval / mmlu_redux · mmlu_redux
professional knowledge49.4
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#3代码55.7正式评分全站排名 #153/4 实测维度
80% 区间: 47.663.8
code generation59.2
livecodebench · live_code_bench_v6 / livecodebench · livecodebench / scicode · scicode
repository engineering49.1
nl2repo · nl2_repo / swe_pro · swe_pro
debugging testing58.8
swe_multilingual · benchlm_coding_swe_multilingual / swe_verified · swe_verified
tooling quality仅先验
#4多语言51.7估算2/4 实测维度
80% 区间: 39.563.9
cross language understanding45.3
nova · nova63
multilingual generation仅先验
reasoning transfer58.1
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#5数学49.9估算3/4 实测维度
80% 区间: 40.858.9
foundational math仅先验
competition math46.5
aime · aime2026 / hmmt · hmmt_feb2025 / hmmt · hmmt_feb2026 / hmmt · hmmt_nov2025
proof frontier50.3
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math52.8
mmanswer · mm_answer_bench
#6智能体48.6正式评分全站排名 #384/4 实测维度
80% 区间: 43.253.9
planning57.9
deep_planning · gert_labs
tool use42.7
mcp_atlas · mcp_atlas / mcp_tasks · mcp_tasks / tau · tau2_bench / tau · tau3_bench / toolathlon · toolathlon
environment execution48.4
osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2 / vita_bench · vita_bench / wide_research · wide_research
recovery reliability45.2
claw_eval · claw_eval / cyber_gym · cyber_gym / jobbench · job_bench
#7指令遵循45.7估算2/4 实测维度
80% 区间: 33.857.6
constraint following47.1
ifeval · ifeval
structured output仅先验
novel instruction generalization44.3
ifbench · aa_if_bench
long multiturn instruction仅先验
#8多模态32.4正式评分全站排名 #104/4 实测维度
80% 区间: 26.038.9
perception ocr29.4
v_star · v_star
document spatial39.4
charxiv · charxiv
visual reasoning26.3
mathvision · math_vision / mmmu_pro · mmmu_pro
video action34.5
screenspot · screen_spot_pro / video_mmmu · video_mmmu

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
200Ktokens
240 pages of text
OUTPUT
64Ktokens
8K128K1M4M
200K

能力

Technical Details

输入
输出
发布日期
Nov 2025
官方文档
Tokenizer
Claude
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_kverbosity

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月31日

综合

1 个指标

Overall score54.0#57 / 100
Overall score
站内排名#57
分数54.0
更新时间2026年8月31日
置信度4

价格

2 个指标

输入价格$5.00/M#164 / 180输出价格$25.00/M#165 / 180
输入价格
Input price
站内排名#164
分数$5.00/M
更新时间2026年8月31日
置信度4
输出价格
Output price
站内排名#165
分数$25.00/M
更新时间2026年8月31日
置信度4

智能体

V3.0

17 个指标 · 正式评分

分数48.6#3880% 区间43.2–53.94/4 实测维度Agentic score48.5#52 / 69Terminal-Bench 2.059.3#33 / 53
维度与证据
规划拆解57.9
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 1.07 · q 1.00
工具调用42.7
4 个基准族 · 5 个指标
mcp_atlas · mcp_atlas · z -2.31 · q 1.00
mcp_tasks · mcp_tasks · z 0.00 · q 0.63
tau · tau2_bench · z 0.01 · q 1.00
tau · tau3_bench · z 0.00 · q 1.00
toolathlon · toolathlon · z -0.46 · q 1.00
环境与长程执行48.4
4 个基准族 · 4 个指标
osworld · os_world_verified · z -0.59 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.28 · q 1.00
vita_bench · vita_bench · z -0.64 · q 1.00
wide_research · wide_research · z 0.89 · q 1.00
恢复与完成可靠性45.2
3 个基准族 · 3 个指标
claw_eval · claw_eval · z 0.00 · q 1.00
cyber_gym · cyber_gym · z -2.03 · q 1.00
jobbench · job_bench · z 0.00 · q 1.00
Agentic score
站内排名#52
分数48.5
更新时间2026年8月31日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#33
分数59.3
更新时间2026年8月31日
置信度4
OSWorld-VerifiedV3 计分证据
站内排名#19
分数66.3
更新时间2026年8月31日
置信度4
OSWorld
站内排名#1
分数66.3
更新时间2026年8月31日
置信度4
Claw-EvalV3 计分证据
站内排名#14
分数59.6
更新时间2026年8月31日
置信度4
QwenClawBench
站内排名#9
分数52.3
更新时间2026年8月31日
置信度4
Τ³-bench resultsV3 计分证据
站内排名#5
分数70.2
更新时间2026年8月31日
置信度4
VITA-BenchV3 计分证据
站内排名#6
分数23.3
更新时间2026年8月31日
置信度4
DeepPlanningV3 计分证据
站内排名#4
分数26.4
更新时间2026年8月31日
置信度4
ToolathlonV3 计分证据
站内排名#16
分数43.5
更新时间2026年8月31日
置信度4
MCP AtlasV3 计分证据
站内排名#29
分数42.3
更新时间2026年8月31日
置信度4
MCP-TasksV3 计分证据
站内排名#3
分数71.8
更新时间2026年8月31日
置信度4
WideResearchV3 计分证据
站内排名#3
分数76.4
更新时间2026年8月31日
置信度4
CyberGymV3 计分证据
站内排名#14
分数50.6
更新时间2026年8月31日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#40
分数86.3
更新时间2026年8月31日
置信度4
Gert LabsV3 计分证据
站内排名#6
分数64.2
更新时间2026年8月31日
置信度4
JobBenchV3 计分证据
站内排名#12
分数32.3
更新时间2026年8月31日
置信度4

代码

V3.0

9 个指标 · 正式评分

分数55.7#1580% 区间47.6–63.83/4 实测维度LiveCodeBench73.8%#24 / 115SciCode47.0%#35 / 205
维度与证据
代码生成59.2
2 个基准族 · 3 个指标
livecodebench · live_code_bench_v6 · z -0.38 · q 0.75
livecodebench · livecodebench · z 1.29 · q 1.00
scicode · scicode · z 1.03 · q 1.00
仓库工程49.1
2 个基准族 · 2 个指标
nl2repo · nl2_repo · z 0.08 · q 1.00
swe_pro · swe_pro · z 0.06 · q 1.00
调试与测试58.8
2 个基准族 · 2 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z 0.60 · q 1.00
swe_verified · swe_verified · z 0.87 · q 1.00
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#24
分数73.8%
更新时间2026年8月31日
置信度4
SciCodeV3 计分证据
站内排名#35
分数47.0%
更新时间2026年8月31日
置信度4
Coding score
站内排名#40
分数53.3
更新时间2026年8月31日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#7
分数80.9
更新时间2026年8月31日
置信度4
LiveCodeBench v6V3 计分证据
站内排名#5
分数84.8
更新时间2026年8月31日
置信度4
SWE-bench ProV3 计分证据
站内排名#24
分数57.1
更新时间2026年8月31日
置信度4
SWE MultilingualV3 计分证据
站内排名#7
分数77.5
更新时间2026年8月31日
置信度4
NL2RepoV3 计分证据
站内排名#6
分数43.2
更新时间2026年8月31日
置信度4
AA-SciCodeV3 计分证据
站内排名#40
分数47.0
更新时间2026年8月31日
置信度4

综合推理

V3.0

8 个指标 · 正式评分

分数60.7#380% 区间52.5–68.83/4 实测维度MMLU-Pro88.9%#4 / 129GPQA81.0%#91 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理53.4
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z 0.62 · q 1.00
hle · hle · z 0.65 · q 1.00
多步约束61.7
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 1.35 · q 1.00
证据整合与验证67
3 个基准族 · 3 个指标
ai_needle · ai_needle · z 2.61 · q 0.50
lcr · lcr · z -0.17 · q 1.00
longbench · long_bench_v2 · z 1.78 · q 1.00
MMLU-ProV3 计分证据
站内排名#4
分数88.9%
更新时间2026年8月31日
置信度4
GPQAV3 计分证据
站内排名#91
分数81.0%
更新时间2026年8月31日
置信度4
HLEV3 计分证据
站内排名#103
分数13.2%
更新时间2026年8月31日
置信度4
Reasoning score
站内排名#9
分数77.0
更新时间2026年8月31日
置信度4
LongBench v2V3 计分证据
站内排名#2
分数64.4
更新时间2026年8月31日
置信度4
AI-NeedleV3 计分证据
站内排名#1
分数74.0
更新时间2026年8月31日
置信度4
AA-LCRV3 计分证据
站内排名#61
分数67.3
更新时间2026年8月31日
置信度4
CritPtV3 计分证据
站内排名#78
分数0.3
更新时间2026年8月31日
置信度4

知识

V3.0

10 个指标 · 估算

分数57.680% 区间45.9–69.22/4 实测维度Knowledge score58.0#50 / 69SuperGPQA70.6#7 / 16
维度与证据
广泛知识65.7
2 个基准族 · 2 个指标
c_eval · c_eval · z 0.00 · q 0.63
mmlu_redux · mmlu_redux · z 3.00 · q 0.75
专业知识49.4
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z 0.18 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#50
分数58.0
更新时间2026年8月31日
置信度4
SuperGPQAV3 计分证据
站内排名#7
分数70.6
更新时间2026年8月31日
置信度4
MMLU-ReduxV3 计分证据
站内排名#1
分数96.6
更新时间2026年8月31日
置信度4
C-EvalV3 计分证据
站内排名#3
分数92.2
更新时间2026年8月31日
置信度4
Artificial Analysis Intelligence Index
站内排名#59
分数35.6
更新时间2026年8月31日
置信度4
AA-GPQA Diamond
站内排名#71
分数81.0
更新时间2026年8月31日
置信度4
AA-HLE
站内排名#77
分数13.2
更新时间2026年8月31日
置信度4
AA-Omniscience Accuracy
站内排名#28
分数40.9
更新时间2026年8月31日
置信度4
AA-Omniscience Hallucination Rate
站内排名#48
分数76.2
更新时间2026年8月31日
置信度4
AA MMLU-Pro
站内排名#2
分数88.9
更新时间2026年8月31日
置信度4

数学

V3.0

8 个指标 · 估算

分数49.980% 区间40.8–58.93/4 实测维度Math score58.4#29 / 62AIME2695.1#9 / 14
维度与证据
基础数学仅先验
竞赛数学46.5
2 个基准族 · 4 个指标
aime · aime2026 · z -0.18 · q 1.00
hmmt · hmmt_feb2025 · z -0.80 · q 0.88
hmmt · hmmt_feb2026 · z -0.30 · q 1.00
hmmt · hmmt_nov2025 · z 0.00 · q 1.00
高阶证明50.3
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z -0.24 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z -0.11 · q 1.00
应用与工具辅助数学52.8
1 个基准族 · 1 个指标
mmanswer · mm_answer_bench · z 0.42 · q 1.00
Math score
站内排名#29
分数58.4
更新时间2026年8月31日
置信度4
AIME26V3 计分证据
站内排名#9
分数95.1
更新时间2026年8月31日
置信度4
HMMT Feb 2025V3 计分证据
站内排名#6
分数92.9
更新时间2026年8月31日
置信度4
HMMT Nov 2025V3 计分证据
站内排名#5
分数93.3
更新时间2026年8月31日
置信度4
HMMT Feb 2026V3 计分证据
站内排名#15
分数85.3
更新时间2026年8月31日
置信度4
MMAnswerBenchV3 计分证据
站内排名#3
分数84.0
更新时间2026年8月31日
置信度4
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#29
分数20.7
更新时间2026年8月31日
置信度4
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#23
分数4.2
更新时间2026年8月31日
置信度4

多语言

V3.0

3 个指标 · 估算

分数51.780% 区间39.5–63.92/4 实测维度Multilingual score82.9#2 / 11MMLU-ProX85.7#2 / 11
维度与证据
跨语言理解45.3
1 个基准族 · 1 个指标
nova · nova63 · z -0.63 · q 0.88
多语言生成仅先验
推理迁移58.1
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z 1.28 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#2
分数82.9
更新时间2026年8月31日
置信度4
MMLU-ProXV3 计分证据
站内排名#2
分数85.7
更新时间2026年8月31日
置信度4
NOVA-63V3 计分证据
站内排名#5
分数56.7
更新时间2026年8月31日
置信度4

多模态

V3.0

9 个指标 · 正式评分

分数32.4#1080% 区间26.0–38.94/4 实测维度Multimodal Grounded score13.5#43 / 44MMMU-Pro70.6#29 / 31
维度与证据
感知与 OCR29.4
1 个基准族 · 1 个指标
v_star · v_star · z -3.00 · q 1.00
文档与空间理解39.4
1 个基准族 · 1 个指标
charxiv · charxiv · z -1.29 · q 1.00
视觉推理26.3
2 个基准族 · 2 个指标
mathvision · math_vision · z -3.00 · q 1.00
mmmu_pro · mmmu_pro · z -1.72 · q 1.00
视频与落地行动34.5
2 个基准族 · 2 个指标
screenspot · screen_spot_pro · z -2.46 · q 1.00
video_mmmu · video_mmmu · z -0.17 · q 1.00
Multimodal Grounded score
站内排名#43
分数13.5
更新时间2026年8月31日
置信度4
MMMU-ProV3 计分证据
站内排名#29
分数70.6
更新时间2026年8月31日
置信度4
MathVisionV3 计分证据
站内排名#13
分数74.3
更新时间2026年8月31日
置信度4
CharXivV3 计分证据
站内排名#27
分数68.5
更新时间2026年8月31日
置信度4
VideoMMMUV3 计分证据
站内排名#7
分数84.4
更新时间2026年8月31日
置信度4
ScreenSpot ProV3 计分证据
站内排名#11
分数45.7
更新时间2026年8月31日
置信度4
V*V3 计分证据
站内排名#11
分数67.0
更新时间2026年8月31日
置信度4
AA-MMMU-Pro
站内排名#46
分数71.2
更新时间2026年8月31日
置信度4
Design Arena Website
站内排名#32
分数1267.0
更新时间2026年8月31日
置信度4

指令遵循

V3.0

4 个指标 · 估算

分数45.780% 区间33.8–57.62/4 实测维度Instruction Following score56.4#23 / 25IFEval90.9#12 / 16
维度与证据
约束遵循47.1
1 个基准族 · 1 个指标
ifeval · ifeval · z -0.59 · q 1.00
结构化输出仅先验
新指令泛化44.3
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.04 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#23
分数56.4
更新时间2026年8月31日
置信度4
IFEvalV3 计分证据
站内排名#12
分数90.9
更新时间2026年8月31日
置信度4
IFBenchV3 计分证据
站内排名#13
分数58.0
更新时间2026年8月31日
置信度4
AA-IFBenchV3 计分证据
站内排名#62
分数43.0
更新时间2026年8月31日
置信度4

OpenRouter 端点

6 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Azure
azure/global
$5/M$25/M100%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/eu-west-1
$5.50/M$27.50/M100%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock
$5/M$25/M99.9%undefined tokens / undefined tokens
Google
google-vertex/global
$5/M$25/M99.8%undefined tokens / undefined tokens
Anthropic
anthropic
$5/M$25/M99.8%undefined tokens / undefined tokens
Claude Platform on AWS
claude-on-aws
$5/M$25/M99.7%undefined tokens / undefined tokens

价格对比

对比 Claude Opus 4.5 在 567 家服务商的 API 价格。价格从 $0.0068/request 到 $8000.00/M,其中 钠 API 提供最低价 $0.0068/request。 6 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
claude-opus-4-5-20251101
default
-86%$0.685/M
Cache read$0.068/M
-86%$3.42/M
56.5 t/s
2.60 s
L1
100%
claude-opus-4-5-20251101
aws-q
-96%$0.214/M
Cache read$0.021/M
-96%$1.07/M
L1
100%
claude-opus-4-5-20251101
default
-93%$0.342/M
Cache read$0.034/M
-93%$1.71/M
L1
100%
claude-opus-4-5-20251101
claude_kiro
-65%$1.75/M
-65%$8.75/M
L1
99%
claude-opus-4-5-20251101
aws
-99%$0.059/M
Cache read$0.0059/MCache write$0.073/MCache write 1h$0.117/M
-99%$0.294/M
L1
100%
claude-opus-4-5-20251101
default
-86%$0.685/M
Cache read$0.068/MCache write$0.856/MCache write 1h$1.37/M
-86%$3.42/M
L1
100%
claude-opus-4-5
default
-86%$0.685/M
-86%$3.42/M
L1
100%
claude-opus-4-5-20251101
default
-86%$0.685/M
-86%$3.42/M
L1
100%
claude-opus-4.5
default
-59%$2.05/M
-59%$10.27/M
L1
100%
claude-opus-4-5-20251101
default
$5.00/M
Cache read$0.500/MCache write$6.25/MCache write 1h$10.00/M
$25.00/M
L1
100%
claude-opus-4-5-20251101
default
-23%$3.84/M
-23%$19.18/M
兔子API
免费
L1
100%
claude-opus-4-5-20251101
default
免费
免费
L1
100%
claude-opus-4-5
Claude-Code
免费
免费
L1
100%
claude-opus-4-5-20251101
claude-huaqiangbei
-95%$0.250/M
Cache read$0.025/M
-95%$1.25/M
L1
100%
claude-opus-4-5
claude-kiro-sale
-90%$0.500/M
-90%$2.50/M
L1
100%
claude-opus-4-5-20251101-c
default
$0.428/request
-
L1
100%
claude-opus-4-5-20251101
default
$5.00/M
Cache read$0.500/MCache write$6.25/MCache write 1h$10.00/M
$25.00/M
L1
100%
claude-opus-4-5-20251101
cc-sale
-89%$0.548/M
Cache read$0.055/MCache write$0.685/MCache write 1h$1.10/M
-89%$2.74/M
L1
100%
claude-opus-4-5-20251101
claude-MAX1-企业版
-82%$0.923/M
Cache read$0.092/MCache write$1.15/MCache write 1h$1.85/M
-82%$4.61/M
L1
100%
claude-opus-4-5-20251101
claude
-81%$0.959/M
Cache read$0.096/MCache write$1.20/MCache write 1h$1.92/M
-81%$4.79/M
当前显示 20 个模型 ID,共 120 个。

替代方案与相似模型

常见问题

Claude Opus 4.5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Claude Opus 4.5 的基准测试、API 价格、输出速度、首字延迟和 573 家服务商数据。
Claude Opus 4.5 API 价格是多少?
Claude Opus 4.5573 家服务商有价格记录,价格从 $0.0068/request $8000.00/M。最低价由 钠 API 提供。
Claude Opus 4.5 API 价格表包含什么?
Claude Opus 4.5 API 价格表会对比 573 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Claude Opus 4.5 API 价格最低?
钠 API 当前提供 Claude Opus 4.5 的最低收录价格:$0.0068/request,共对比 573 家服务商。
可以同时对比 Claude Opus 4.5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Claude Opus 4.5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Claude Opus 4.5 的 API 免费吗?
是的,Claude Opus 4.5 免费 API 可通过 LMSpeed 上的 6 家服务商使用,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Claude Opus 4.5 免费 API?
LMSpeed 当前收录了 6 家 Claude Opus 4.5 免费 API 服务商,包括兔子API, 兔子API, 兔子API, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

42API/claude-opus-4-5-20251101AWS/claude-opus-4-5-20251101Claude-Opus-4.5[hm]q|Windsurf/claude-opus-4-5[hm]q|kiro/claude-opus-4-5-20251101

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档