Anthropic
·Released on 2026年2月4日

Claude Opus 4.6 API 基准测试 价格和服务商数据

选择与 Claude Opus 4.6 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Claude Opus 4.6 页面汇总基准测试、API 价格和服务商数据,覆盖 1090 家服务商,价格从 $0.0010/M 起。Claude Opus 4.6 免费 API 额度来自 7 家服务商。页面同时展示实测速度和首字延迟。

Anthropic 的 Claude Opus 4.6是语言模型,专为通用对话与文本生成任务优化。

质量
#27of 100
65.0
LMSpeed 评分
速度
45char/s
5.30 s
成本
#165of 181
$0.0010/ 1M · 8:1 in:out
$0.0002 in · $0.0009 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
8 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体54.9代码59综合推理53.4知识53.7数学56.5多语言54多模态48.4指令遵循44.7
#1代码59正式评分全站排名 #83/4 实测维度
80% 区间: 50.967.0
code generation55.3
livecodebench · live_code_bench_pro / scicode · scicode
repository engineering54.6
react_native_bench · react_native_evals / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing66.9
swe_rebench · swe_rebench / swe_verified · swe_verified
tooling quality仅先验
#2数学56.5暂定评分1/4 实测维度
80% 区间: 40.472.5
foundational math仅先验
competition math仅先验
proof frontier56.5
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#3智能体54.9正式评分全站排名 #214/4 实测维度
80% 区间: 49.260.6
planning56.6
deep_planning · gert_labs
tool use50.5
tau · tau2_bench
environment execution52.8
browsecomp · browse_comp / deep_search_qa · deep_search_qa / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability59.6
apex_agents · apex_agents_aa / claw_eval · claw_eval / cyber_gym · cyber_gym / jobbench · job_bench / researchclaw · research_claw_bench
#4多语言54暂定评分1/4 实测维度
80% 区间: 36.771.3
cross language understanding54
global_mmlu · aa_global_mmlu_lite
multilingual generation仅先验
reasoning transfer仅先验
low resource robustness仅先验
#5知识53.7暂定评分1/4 实测维度
80% 区间: 40.167.4
broad knowledge仅先验
professional knowledge53.7
healthbench · health_bench_hard / medxpert · med_xpert_qa_text / supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#6综合推理53.4正式评分全站排名 #293/4 实测维度
80% 区间: 44.862.1
abstract logic仅先验
scientific causal57.9
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints53.3
mmlu_pro · mmlu_pro
evidence verification49.2
lcr · lcr
#7多模态48.4估算2/4 实测维度
80% 区间: 37.259.5
perception ocr仅先验
document spatial仅先验
visual reasoning41.2
erqa · erqa / medxpert · med_xpert_qa_mm / mmmu_pro · mmmu_pro
video action55.5
screenspot · screen_spot_pro
#8指令遵循44.7暂定评分1/4 实测维度
80% 区间: 28.760.8
constraint following仅先验
structured output仅先验
novel instruction generalization44.7
ifbench · aa_if_bench
long multiturn instruction仅先验

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1M

能力

Technical Details

输入
输出
发布日期
Feb 2026
官方文档
Tokenizer
Claude
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_pverbosity

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score65.0#27 / 100
Overall score
站内排名#27
分数65.0
更新时间2026年9月1日
置信度3

价格

2 个指标

输入价格$5.00/M#165 / 181输出价格$25.00/M#166 / 181
输入价格
Input price
站内排名#165
分数$5.00/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#166
分数$25.00/M
更新时间2026年9月1日
置信度4

智能体

V3.0

12 个指标 · 正式评分

分数54.9#2180% 区间49.2–60.64/4 实测维度Agentic score65.3#30 / 69Terminal-Bench 2.065.4#24 / 53
维度与证据
规划拆解56.6
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.89 · q 1.00
工具调用50.5
1 个基准族 · 1 个指标
tau · tau2_bench · z -0.05 · q 1.00
环境与长程执行52.8
4 个基准族 · 4 个指标
browsecomp · browse_comp · z 0.31 · q 1.00
deep_search_qa · deep_search_qa · z -0.41 · q 1.00
osworld · os_world_verified · z -0.04 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.10 · q 1.00
恢复与完成可靠性59.6
5 个基准族 · 5 个指标
apex_agents · apex_agents_aa · z 0.50 · q 1.00
claw_eval · claw_eval · z 1.87 · q 1.00
cyber_gym · cyber_gym · z -0.87 · q 1.00
jobbench · job_bench · z 0.27 · q 1.00
researchclaw · research_claw_bench · z 0.57 · q 1.00
Agentic score
站内排名#30
分数65.3
更新时间2026年9月1日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#24
分数65.4
更新时间2026年9月1日
置信度3
BrowseCompV3 计分证据
站内排名#10
分数83.7
更新时间2026年9月1日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#15
分数72.7
更新时间2026年9月1日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#46
分数84.8
更新时间2026年9月1日
置信度3
Claw-EvalV3 计分证据
站内排名#3
分数70.4
更新时间2026年9月1日
置信度3
DeepSearchQAV3 计分证据
站内排名#10
分数73.7
更新时间2026年9月1日
置信度3
CyberGymV3 计分证据
站内排名#11
分数66.6
更新时间2026年9月1日
置信度3
Gert LabsV3 计分证据
站内排名#10
分数61.9
更新时间2026年9月1日
置信度3
ResearchClawBenchV3 计分证据
站内排名#4
分数19.9
更新时间2026年9月1日
置信度3
JobBenchV3 计分证据
站内排名#8
分数36.7
更新时间2026年9月1日
置信度3
APEX-Agents-AAV3 计分证据
站内排名#8
分数33.0
更新时间2026年8月20日
置信度1

代码

V3.0

11 个指标 · 正式评分

分数59#880% 区间50.9–67.03/4 实测维度SciCode45.7%#45 / 206Coding score63.2#10 / 81
维度与证据
代码生成55.3
2 个基准族 · 2 个指标
livecodebench · live_code_bench_pro · z -0.90 · q 0.50
scicode · scicode · z 1.27 · q 1.00
仓库工程54.6
3 个基准族 · 3 个指标
react_native_bench · react_native_evals · z 0.80 · q 1.00
swe_pro · swe_pro · z -0.62 · q 1.00
vibecode · vibe_code_bench · z 1.10 · q 1.00
调试与测试66.9
2 个基准族 · 2 个指标
swe_rebench · swe_rebench · z 2.55 · q 1.00
swe_verified · swe_verified · z 0.85 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#45
分数45.7%
更新时间2026年9月1日
置信度4
Coding score
站内排名#10
分数63.2
更新时间2026年9月1日
置信度3
SWE-bench VerifiedV3 计分证据
站内排名#8
分数80.8
更新时间2026年9月1日
置信度3
SWE-bench Verified*
站内排名#1
分数75.6
更新时间2026年9月1日
置信度3
LiveCodeBench ProV3 计分证据
站内排名#4
分数70.7
更新时间2026年9月1日
置信度3
SWE-bench ProV3 计分证据
站内排名#40
分数53.4
更新时间2026年9月1日
置信度3
SWE-RebenchV3 计分证据
站内排名#1
分数65.3
更新时间2026年9月1日
置信度3
React Native EvalsV3 计分证据
站内排名#3
分数84.1
更新时间2026年9月1日
置信度3
Vibe Code BenchV3 计分证据
站内排名#5
分数57.6
更新时间2026年9月1日
置信度3
AA-SciCodeV3 计分证据
站内排名#47
分数45.7
更新时间2026年9月1日
置信度3
FrontierCode 1.1 Main
站内排名#9
分数26.9
更新时间2026年9月1日
置信度3

综合推理

V3.0

5 个指标 · 正式评分

分数53.4#2980% 区间44.8–62.13/4 实测维度MMLU-Pro82.0%#50 / 129GPQA84.0%#70 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理57.9
3 个基准族 · 4 个指标
critpt · critpt · z 0.00 · q 1.00
gpqa · gpqa · z 0.91 · q 1.00
hle · hle · z 0.94 · q 1.00
hle · hle_no_tools · z -0.15 · q 1.00
多步约束53.3
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.23 · q 1.00
证据整合与验证49.2
1 个基准族 · 1 个指标
lcr · lcr · z -0.47 · q 1.00
MMLU-ProV3 计分证据
站内排名#50
分数82.0%
更新时间2026年9月1日
置信度3
GPQAV3 计分证据
站内排名#70
分数84.0%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#83
分数19.1%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#73
分数62.3
更新时间2026年9月1日
置信度3
CritPtV3 计分证据
站内排名#52
分数2.8
更新时间2026年9月1日
置信度3

知识

V3.0

13 个指标 · 暂定评分

分数53.780% 区间40.1–67.41/4 实测维度Knowledge score82.4#12 / 69GPQA-D89.2#18 / 31
维度与证据
广泛知识仅先验
专业知识53.7
3 个基准族 · 3 个指标
healthbench · health_bench_hard · z -2.08 · q 0.88
medxpert · med_xpert_qa_text · z -0.45 · q 0.50
supergpqa · super_gpqa · z 3.00 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#12
分数82.4
更新时间2026年9月1日
置信度3
GPQA-D
站内排名#18
分数89.2
更新时间2026年9月1日
置信度3
SuperGPQAV3 计分证据
站内排名#1
分数95.0
更新时间2026年9月1日
置信度3
MMLU-Pro (Arcee)
站内排名#1
分数89.1
更新时间2026年9月1日
置信度3
HLE w/o tools
站内排名#13
分数40.0
更新时间2026年9月1日
置信度3
HealthBench HardV3 计分证据
站内排名#7
分数14.8
更新时间2026年9月1日
置信度3
MedXpertQA (Text)V3 计分证据
站内排名#3
分数52.1
更新时间2026年9月1日
置信度3
Artificial Analysis Intelligence Index
站内排名#48
分数38.8
更新时间2026年9月1日
置信度3
AA-GPQA Diamond
站内排名#62
分数84.0
更新时间2026年9月1日
置信度3
AA-HLE
站内排名#68
分数19.1
更新时间2026年9月1日
置信度3
AA-Omniscience Index
站内排名#31
分数2.4
更新时间2026年9月1日
置信度3
AA-Omniscience Accuracy
站内排名#20
分数45.8
更新时间2026年9月1日
置信度3
AA-Omniscience Hallucination Rate
站内排名#43
分数80.1
更新时间2026年9月1日
置信度3

数学

V3.0

4 个指标 · 暂定评分

分数56.580% 区间40.4–72.51/4 实测维度Math score59.6#28 / 62AIME25 (Arcee)99.8#1 / 5
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明56.5
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.85 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.45 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#28
分数59.6
更新时间2026年9月1日
置信度3
AIME25 (Arcee)
站内排名#1
分数99.8
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#10
分数40.7
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#10
分数22.9
更新时间2026年9月1日
置信度3

多语言

V3.0

1 个指标 · 暂定评分

分数5480% 区间36.7–71.31/4 实测维度AA Global-MMLU-Lite92.2#2 / 4
维度与证据
跨语言理解54
1 个基准族 · 1 个指标
global_mmlu · aa_global_mmlu_lite · z 0.00 · q 0.50
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
AA Global-MMLU-LiteV3 计分证据
站内排名#2
分数92.2
更新时间2026年8月20日
置信度1

多模态

V3.0

7 个指标 · 估算

分数48.480% 区间37.2–59.52/4 实测维度Multimodal Grounded score54.8#29 / 44MMMU-Pro77.3#21 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理41.2
3 个基准族 · 3 个指标
erqa · erqa · z -1.94 · q 1.00
medxpert · med_xpert_qa_mm · z -0.93 · q 0.75
mmmu_pro · mmmu_pro · z -0.29 · q 1.00
视频与落地行动55.5
1 个基准族 · 1 个指标
screenspot · screen_spot_pro · z 0.44 · q 1.00
Multimodal Grounded score
站内排名#29
分数54.8
更新时间2026年9月1日
置信度3
MMMU-ProV3 计分证据
站内排名#21
分数77.3
更新时间2026年9月1日
置信度3
ERQAV3 计分证据
站内排名#8
分数51.6
更新时间2026年9月1日
置信度3
ScreenSpot ProV3 计分证据
站内排名#5
分数83.1
更新时间2026年9月1日
置信度3
MedXpertQA (MM)V3 计分证据
站内排名#6
分数64.8
更新时间2026年9月1日
置信度3
AA-MMMU-Pro
站内排名#43
分数72.5
更新时间2026年9月1日
置信度3
Design Arena Website
站内排名#10
分数1311.0
更新时间2026年9月1日
置信度3

指令遵循

V3.0

1 个指标 · 暂定评分

分数44.780% 区间28.7–60.81/4 实测维度AA-IFBench44.6#59 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化44.7
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -0.97 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#59
分数44.6
更新时间2026年9月1日
置信度3

OpenRouter 端点

6 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Google
google-vertex/europe
$5.50/M$27.50/M100%undefined tokens / undefined tokens
Google
google-vertex/global
$5/M$25/M100.0%undefined tokens / undefined tokens
Claude Platform on AWS
claude-on-aws
$5/M$25/M100.0%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock
$5/M$25/M99.9%undefined tokens / undefined tokens
Anthropic
anthropic
$5/M$25/M99.5%undefined tokens / undefined tokens
Azure
azure/global
$5/M$25/M97.6%undefined tokens / undefined tokens

价格对比

对比 Claude Opus 4.6 在 1083 家服务商的 API 价格。价格从 $0.0010/M 到 $49950.00/M,其中 钠 API 提供最低价 $0.0010/M。 7 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
claude-opus-4-6
default
$6.00/M
Cache read$0.600/MCache write$7.50/MCache write 1h$12.00/M
$30.00/M
112.9 t/s
2.19 s
L1
69%
claude-opus-4-6
活动分组1
-94%$0.286/M
-94%$1.43/M
83.7 t/s
3.92 s
L1
69%
claude-opus-4-6-thinking
活动分组1
-94%$0.286/M
-94%$1.43/M
L1
100%
claude-opus-4-6
default
-86%$0.685/M
Cache read$0.068/M
-86%$3.42/M
45.9 t/s
2.56 s
L1
0%
claude-opus-4-6
kiro低缓
-95%$0.258/M
Cache read$0.026/MCache write$0.322/MCache write 1h$0.515/M
-95%$1.29/M
45.1 t/s
2.28 s
L1
0%
anthropic/claude-opus-4.6
or
-59%$2.06/M
Cache read$0.206/MCache write$2.58/MCache write 1h$4.12/M
-59%$10.30/M
L1
0%
claude-opus-4-6-fast
特价纯血-bq渠道
$6.18/M
Cache read$0.618/MCache write$7.72/MCache write 1h$12.36/M
$30.90/M
L1
99%
claude-opus-4-6
Claude-Entry
-94%$0.300/M
Cache read$0.030/MCache write$0.375/MCache write 1h$0.600/M
-94%$1.50/M
44.3 t/s
2.80 s
L1
100%
claude-opus-4-6
claude带缓存
$10.95/M
Cache read$1.09/MCache write$13.69/MCache write 1h$21.90/M
$54.75/M
43.6 t/s
3.35 s
L1
99%
claude-opus-4-6
default
$5.35/M
Cache read$0.535/MCache write$6.69/MCache write 1h$10.71/M
$26.77/M
42.5 t/s
1.44 s
L1
99%
claude-opus-4-6
claude
-91%$0.450/M
Cache read$0.150/MCache write$0.300/MCache write 1h$0.480/M
-91%$2.25/M
40.5 t/s
16.14 s
L1
99%
claude-opus-4-6
default
-98%$0.103/M
-98%$0.514/M
40.3 t/s
3.74 s
L1
99%
[按次特价]claude-opus-4-6
default
$0.0068/request
-
L1
100%
L2
0%
claude-opus-4-6
Claude_AG
-98%$0.096/M
Cache read$0.0096/M
-98%$0.479/M
38.4 t/s
2.61 s
L1
100%
claude-opus-4-6
default
$10.00/M
Cache read$2.63/MCache write$1.57/MCache write 1h$2.52/M
$50.00/M
37.2 t/s
3.09 s
L1
19%
claude-opus-4-6
default
免费
免费
33.0 t/s
14.80 s
L1
100%
claude-opus-4-6
default
$5.00/M
Cache read$0.500/MCache write$6.25/MCache write 1h$10.00/M
$25.00/M
27.0 t/s
15.40 s
L1
100%
claude-opus-4-6-20260101
default
$5.00/M
Cache read$0.500/MCache write$6.25/MCache write 1h$10.00/M
$25.00/M
L1
100%
claude-opus-4-6
aws-q
-96%$0.214/M
Cache read$0.021/M
-96%$1.07/M
L1
100%
claude-opus-4-6
default
-93%$0.342/M
Cache read$0.034/M
-93%$1.71/M
当前显示 20 个模型 ID,共 250 个。

替代方案与相似模型

常见问题

Claude Opus 4.6 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Claude Opus 4.6 的基准测试、API 价格、输出速度、首字延迟和 1090 家服务商数据。
Claude Opus 4.6 API 价格是多少?
Claude Opus 4.61090 家服务商有价格记录,价格从 $0.0010/M $49950.00/M。最低价由 钠 API 提供。
Claude Opus 4.6 API 价格表包含什么?
Claude Opus 4.6 API 价格表会对比 1090 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Claude Opus 4.6 API 价格最低?
钠 API 当前提供 Claude Opus 4.6 的最低收录价格:$0.0010/M,共对比 1090 家服务商。
可以同时对比 Claude Opus 4.6 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Claude Opus 4.6 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Claude Opus 4.6 的 API 免费吗?
是的,Claude Opus 4.6 免费 API 可通过 LMSpeed 上的 7 家服务商使用,包括兔子API, 我不是AI神, 我不是AI神, Moyanjdc API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Claude Opus 4.6 免费 API?
LMSpeed 当前收录了 7 家 Claude Opus 4.6 免费 API 服务商,包括兔子API, 我不是AI神, 我不是AI神, Moyanjdc API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

26479061/claude-opus-4-63h15pm/claude-opus-4.642API/claude-opus-4-6AWS/claude-opus-4-6Claude Opus 4.6

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档