Anthropic
·Released on 2026年2月17日

Claude Sonnet 4.6 API 基准测试 价格和服务商数据

选择与 Claude Sonnet 4.6 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Claude Sonnet 4.6 页面汇总基准测试、API 价格和服务商数据,覆盖 827 家服务商,价格从 $0.0030/request 起。Claude Sonnet 4.6 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。

质量
#39of 100
59.0
LMSpeed 评分
速度
#63of 77
66char/s
4.16 s
成本
#156of 181
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体52.7代码55.9综合推理49.8知识70.6数学53.2多语言-多模态45.7指令遵循43.7
#1知识70.6暂定评分1/4 实测维度
80% 区间: 54.386.9
broad knowledge仅先验
professional knowledge70.6
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#2代码55.9正式评分全站排名 #133/4 实测维度
80% 区间: 47.464.5
code generation55.2
scicode · scicode
repository engineering56.2
react_native_bench · react_native_evals / vibecode · vibe_code_bench
debugging testing56.3
swe_rebench · swe_rebench / swe_verified · swe_verified
tooling quality仅先验
#3数学53.2暂定评分1/4 实测维度
80% 区间: 37.169.2
foundational math仅先验
competition math仅先验
proof frontier53.2
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
#4智能体52.7正式评分全站排名 #294/4 实测维度
80% 区间: 46.558.8
planning57.2
deep_planning · gert_labs
tool use49
tau · tau2_bench
environment execution49.1
osworld · os_world2 / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability55.5
claw_eval · claw_eval / cyber_gym · cyber_gym / jobbench · job_bench
#5综合推理49.8正式评分全站排名 #413/4 实测维度
80% 区间: 41.258.5
abstract logic仅先验
scientific causal49.5
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints50.9
mmlu_pro · mmlu_pro
evidence verification49.2
lcr · lcr
#6多模态45.7暂定评分1/4 实测维度
80% 区间: 29.661.8
perception ocr仅先验
document spatial45.7
charxiv · charxiv
visual reasoning仅先验
video action仅先验
#7指令遵循43.7暂定评分1/4 实测维度
80% 区间: 27.759.7
constraint following仅先验
structured output仅先验
novel instruction generalization43.7
ifbench · aa_if_bench
long multiturn instruction仅先验
暂无数据:多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1M

能力

Technical Details

输入
输出
发布日期
Feb 2026
官方文档
Tokenizer
Claude
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_pverbosity

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月1日

综合

1 个指标

Overall score59.0#39 / 100
Overall score
站内排名#39
分数59.0
更新时间2026年9月1日
置信度3

价格

2 个指标

输入价格$3.00/M#156 / 181输出价格$15.00/M#156 / 181
输入价格
Input price
站内排名#156
分数$3.00/M
更新时间2026年9月1日
置信度4
输出价格
Output price
站内排名#156
分数$15.00/M
更新时间2026年9月1日
置信度4

智能体

V3.0

9 个指标 · 正式评分

分数52.7#2980% 区间46.5–58.84/4 实测维度Agentic score55.0#42 / 69Terminal-Bench 2.059.1#35 / 53
维度与证据
规划拆解57.2
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 0.97 · q 1.00
工具调用49
1 个基准族 · 1 个指标
tau · tau2_bench · z -0.25 · q 1.00
环境与长程执行49.1
2 个基准族 · 3 个指标
osworld · os_world2 · z -0.60 · q 1.00
osworld · os_world_verified · z -0.09 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.29 · q 1.00
恢复与完成可靠性55.5
3 个基准族 · 3 个指标
claw_eval · claw_eval · z 1.40 · q 1.00
cyber_gym · cyber_gym · z -0.98 · q 1.00
jobbench · job_bench · z 0.28 · q 1.00
Agentic score
站内排名#42
分数55.0
更新时间2026年9月1日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#35
分数59.1
更新时间2026年9月1日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#16
分数72.1
更新时间2026年9月1日
置信度3
Claw-EvalV3 计分证据
站内排名#5
分数67.8
更新时间2026年9月1日
置信度3
CyberGymV3 计分证据
站内排名#12
分数65.2
更新时间2026年9月1日
置信度3
Τ²-bench resultsV3 计分证据
站内排名#55
分数79.5
更新时间2026年9月1日
置信度3
Gert LabsV3 计分证据
站内排名#8
分数62.9
更新时间2026年9月1日
置信度3
OSWorld 2.0V3 计分证据
站内排名#12
分数8.3
更新时间2026年9月1日
置信度3
JobBenchV3 计分证据
站内排名#7
分数36.9
更新时间2026年9月1日
置信度3

代码

V3.0

11 个指标 · 正式评分

分数55.9#1380% 区间47.4–64.53/4 实测维度SciCode46.8%#39 / 206Coding score63.2#10 / 81
维度与证据
代码生成55.2
1 个基准族 · 1 个指标
scicode · scicode · z 0.58 · q 1.00
仓库工程56.2
2 个基准族 · 2 个指标
react_native_bench · react_native_evals · z 0.31 · q 1.00
vibecode · vibe_code_bench · z 0.90 · q 1.00
调试与测试56.3
2 个基准族 · 2 个指标
swe_rebench · swe_rebench · z 0.70 · q 1.00
swe_verified · swe_verified · z 0.58 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#39
分数46.8%
更新时间2026年9月1日
置信度4
Coding score
站内排名#10
分数63.2
更新时间2026年9月1日
置信度3
SWE-bench VerifiedV3 计分证据
站内排名#15
分数79.6
更新时间2026年9月1日
置信度3
SWE-RebenchV3 计分证据
站内排名#5
分数60.7
更新时间2026年9月1日
置信度3
React Native EvalsV3 计分证据
站内排名#5
分数80.6
更新时间2026年9月1日
置信度3
Vibe Code BenchV3 计分证据
站内排名#7
分数51.5
更新时间2026年9月1日
置信度3
CursorBench v3.1
站内排名#5
分数48.8
更新时间2026年9月1日
置信度3
AA-SciCodeV3 计分证据
站内排名#42
分数46.9
更新时间2026年9月1日
置信度3
FrontierCode 1.1 Main
站内排名#10
分数24.3
更新时间2026年9月1日
置信度3
EEBench
站内排名#14
分数20.4
更新时间2026年8月20日
置信度3
CADGenBench Generation
站内排名#7
分数22.1
更新时间2026年8月20日
置信度3

综合推理

V3.0

5 个指标 · 正式评分

分数49.8#4180% 区间41.2–58.53/4 实测维度MMLU-Pro79.2%#69 / 129GPQA87.5%#46 / 213
维度与证据
抽象逻辑仅先验
科学与因果推理49.5
3 个基准族 · 3 个指标
critpt · critpt · z -0.47 · q 1.00
gpqa · gpqa · z 0.15 · q 1.00
hle · hle · z -0.15 · q 1.00
多步约束50.9
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -0.09 · q 1.00
证据整合与验证49.2
1 个基准族 · 1 个指标
lcr · lcr · z -0.47 · q 1.00
MMLU-ProV3 计分证据
站内排名#69
分数79.2%
更新时间2026年9月1日
置信度3
GPQAV3 计分证据
站内排名#46
分数87.5%
更新时间2026年9月1日
置信度4
HLEV3 计分证据
站内排名#44
分数33.6%
更新时间2026年9月1日
置信度4
AA-LCRV3 计分证据
站内排名#73
分数62.3
更新时间2026年9月1日
置信度3
CritPtV3 计分证据
站内排名#70
分数0.9
更新时间2026年9月1日
置信度3

知识

V3.0

7 个指标 · 暂定评分

分数70.680% 区间54.3–86.91/4 实测维度Knowledge score76.1#19 / 69SuperGPQA95.0#1 / 16
维度与证据
广泛知识仅先验
专业知识70.6
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z 3.00 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#19
分数76.1
更新时间2026年9月1日
置信度3
SuperGPQAV3 计分证据
站内排名#1
分数95.0
更新时间2026年9月1日
置信度3
Artificial Analysis Intelligence Index
站内排名#54
分数36.8
更新时间2026年9月1日
置信度3
AA-GPQA Diamond
站内排名#74
分数79.9
更新时间2026年9月1日
置信度3
AA-HLE
站内排名#76
分数13.3
更新时间2026年9月1日
置信度3
AA-Omniscience Accuracy
站内排名#36
分数38.6
更新时间2026年9月1日
置信度3
AA-Omniscience Hallucination Rate
站内排名#56
分数68.5
更新时间2026年9月1日
置信度3

数学

V3.0

3 个指标 · 暂定评分

分数53.280% 区间37.1–69.21/4 实测维度Math score49.4#37 / 62FrontierMath v2 (Tiers 1-3)32.4#18 / 47
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明53.2
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.17 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.24 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#37
分数49.4
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#18
分数32.4
更新时间2026年9月1日
置信度3
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#19
分数8.3
更新时间2026年9月1日
置信度3

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

4 个指标 · 暂定评分

分数45.780% 区间29.6–61.81/4 实测维度Multimodal Grounded score44.5#36 / 44CharXiv77.4#24 / 29
维度与证据
感知与 OCR仅先验
文档与空间理解45.7
1 个基准族 · 1 个指标
charxiv · charxiv · z -0.45 · q 1.00
视觉推理仅先验
视频与落地行动仅先验
Multimodal Grounded score
站内排名#36
分数44.5
更新时间2026年9月1日
置信度3
CharXivV3 计分证据
站内排名#24
分数77.4
更新时间2026年9月1日
置信度3
AA-MMMU-Pro
站内排名#47
分数70.6
更新时间2026年9月1日
置信度3
Design Arena Website
站内排名#12
分数1304.0
更新时间2026年9月1日
置信度3

指令遵循

V3.0

1 个指标 · 暂定评分

分数43.780% 区间27.7–59.71/4 实测维度AA-IFBench41.2#67 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化43.7
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.11 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#67
分数41.2
更新时间2026年9月1日
置信度3

OpenRouter 端点

9 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Google
google-vertex/europe
$3.30/M$16.50/M100%undefined tokens / undefined tokens
Google
google-vertex/us-east5
$3.30/M$16.50/M100%undefined tokens / undefined tokens
Google
google-vertex/global
$3/M$15/M100.0%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/eu-west-1
$3.30/M$16.50/M100.0%undefined tokens / undefined tokens
Claude Platform on AWS
claude-on-aws
$3/M$15/M100.0%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/global
$3/M$15/M100.0%undefined tokens / undefined tokens
Anthropic
anthropic
$3/M$15/M99.8%undefined tokens / undefined tokens
Azure
azure/global
$3/M$15/M98.6%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/us
$3.30/M$16.50/Mundefined tokens / undefined tokens

价格对比

对比 Claude Sonnet 4.6 在 822 家服务商的 API 价格。价格从 $0.0030/request 到 $4800.00/M,其中 Crond 提供最低价 $0.0030/request。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
claude-sonnet-4-6
default
$3.60/M
Cache read$0.360/MCache write$4.50/MCache write 1h$7.20/M
$18.00/M
85.7 t/s
1.83 s
L1
100%
claude-sonnet-4-6
default
-86%$0.411/M
Cache read$0.041/M
-86%$2.05/M
55.2 t/s
2.09 s
L1
100%
claude-sonnet-4-6
claude--kiro
-86%$0.411/M
Cache read$0.041/MCache write$0.514/MCache write 1h$0.822/M
-86%$2.05/M
47.8 t/s
0.72 s
L1
99%
claude-sonnet-4-6
Claude-Entry
-94%$0.180/M
Cache read$0.018/M
-94%$0.900/M
47.5 t/s
1.59 s
L1
100%
claude-sonnet-4-6
企业用户
$3.00/M
$15.00/M
46.7 t/s
1.07 s
L1
100%
claude-sonnet-4-6
Claude_AG
-98%$0.058/M
Cache read$0.0058/M
-98%$0.288/M
43.1 t/s
2.40 s
L1
100%
claude-sonnet-4-6
aws-q
-96%$0.129/M
Cache read$0.013/M
-96%$0.643/M
42.1 t/s
4.50 s
L1
69%
claude-sonnet-4-6
活动分组1
-94%$0.171/M
-94%$0.857/M
40.9 t/s
3.71 s
L1
100%
claude-sonnet-4-6
default
$75.00/M
$375.00/M
37.7 t/s
3.07 s
L1
100%
L2
0%
claude-sonnet-4-6
Claude_AG
-98%$0.058/M
Cache read$0.0058/M
-98%$0.288/M
31.9 t/s
6.07 s
L1
100%
claude-sonnet-4-6
default
$3.00/M
$15.00/M
26.8 t/s
11.92 s
L1
99%
claude-sonnet-4-6
default
$3.15/M
Cache read$0.315/M
$15.75/M
19.7 t/s
8.43 s
L1
100%
claude-sonnet-4-6
default
-93%$0.205/M
Cache read$0.021/M
-93%$1.03/M
L1
100%
claude-sonnet-4-6-low
claude_kiro
-65%$1.05/M
-65%$5.25/M
L1
100%
claude-sonnet-4-6-high
claude_kiro
-65%$1.05/M
-65%$5.25/M
L1
100%
claude-sonnet-4-6
claude_kiro
-65%$1.05/M
-65%$5.25/M
L1
100%
claude-sonnet-4-6-medium
claude_kiro
-65%$1.05/M
-65%$5.25/M
L1
99%
claude-sonnet-4-6
aws
-99%$0.035/M
Cache read$0.0035/M
-99%$0.176/M
L1
100%
claude-sonnet-4-6
default
$0.041/request
-
L1
100%
claude-sonnet-4.6
default
-86%$0.411/M
-86%$2.05/M
当前显示 20 个模型 ID,共 168 个。

替代方案与相似模型

常见问题

Claude Sonnet 4.6 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Claude Sonnet 4.6 的基准测试、API 价格、输出速度、首字延迟和 827 家服务商数据。
Claude Sonnet 4.6 API 价格是多少?
Claude Sonnet 4.6827 家服务商有价格记录,价格从 $0.0030/request $4800.00/M。最低价由 Crond 提供。
Claude Sonnet 4.6 API 价格表包含什么?
Claude Sonnet 4.6 API 价格表会对比 827 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Claude Sonnet 4.6 API 价格最低?
Crond 当前提供 Claude Sonnet 4.6 的最低收录价格:$0.0030/request,共对比 827 家服务商。
可以同时对比 Claude Sonnet 4.6 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Claude Sonnet 4.6 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Claude Sonnet 4.6 的 API 免费吗?
是的,Claude Sonnet 4.6 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括兔子API, 兔子API, 兔子API, 兔子API, Moyanjdc API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Claude Sonnet 4.6 免费 API?
LMSpeed 当前收录了 5 家 Claude Sonnet 4.6 免费 API 服务商,包括兔子API, 兔子API, 兔子API, 兔子API, Moyanjdc API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

26479061/claude-sonnet-4-63h15pm/claude-sonnet-4.642API/claude-sonnet-4-6AWS/claude-sonnet-4-6Anthropic/Claude-Sonnet-4-6-Free

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档