Anthropic
·Released on 2026年6月30日

Claude Sonnet 5 API 基准测试 价格和服务商数据

选择与 Claude Sonnet 5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Claude Sonnet 5 页面汇总基准测试、API 价格和服务商数据,覆盖 547 家服务商,价格从 $0.010/request 起。Claude Sonnet 5 免费 API 额度来自 6 家服务商。页面同时展示实测速度和首字延迟。

Sonnet 5 is Anthropic's most capable Sonnet-class model, with frontier performance across coding, agents, and professional work. It supports adaptive thinking with selectable reasoning effort levels (...

质量
#10of 112
73.0
LMSpeed 评分
速度
#51of 80
194char/s
6.19 s
成本
#143of 186
$0.010/ 1M · 8:1 in:out
$0.0016 in · $0.0086 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
5 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体62.6代码58.5综合推理56.6知识58.3数学-多语言-多模态56.3指令遵循-
#1智能体62.6暂定评分1/4 实测维度
80% 区间: 50.574.8
planning仅先验
tool use仅先验
environment execution62.6
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability仅先验
#2代码58.5正式评分全站排名 #74/4 实测维度
80% 区间: 51.965.1
code generation56.3
scicode · scicode
repository engineering57.4
swe_pro · swe_pro
debugging testing63.8
swe_multilingual · benchlm_coding_swe_multilingual / swe_verified · swe_verified
tooling quality56.5
terminalbench · benchlm_coding_terminal_bench2
#3知识58.3暂定评分1/4 实测维度
80% 区间: 44.372.3
broad knowledge58.3
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#4综合推理56.6估算2/4 实测维度
80% 区间: 45.967.4
abstract logic仅先验
scientific causal56
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification57.2
lcr · lcr
#5多模态56.3暂定评分1/4 实测维度
80% 区间: 40.272.5
perception ocr仅先验
document spatial56.3
charxiv · charxiv
visual reasoning仅先验
video action仅先验
暂无数据:数学多语言指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
128Ktokens
8K128K1M4M
1M

能力

Technical Details

输入
输出
发布日期
Jun 2026
官方文档
Tokenizer
Claude
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstool_choicetoolsverbosity

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月13日

综合

1 个指标

Overall score73.0#10 / 112
Overall score
站内排名#10
分数73.0
更新时间2026年9月13日
置信度3

速度与延迟

2 个指标

输出速度87.5 tok/s#51 / 80首字延迟122.96 s#80 / 80
输出速度
Output speed
站内排名#51
分数87.5 tok/s
更新时间2026年9月13日
置信度4
首字延迟
Time to first token
站内排名#80
分数122.96 s
更新时间2026年9月13日
置信度4

价格

2 个指标

输入价格$2.00/M#143 / 186输出价格$10.00/M#142 / 186
输入价格
Input price
站内排名#143
分数$2.00/M
更新时间2026年9月13日
置信度4
输出价格
Output price
站内排名#142
分数$10.00/M
更新时间2026年9月13日
置信度4

智能体

V3.0

13 个指标 · 暂定评分

分数62.680% 区间50.5–74.81/4 实测维度Agentic score82.4#11 / 77Terminal-Bench 2.080.4#9 / 53
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行62.6
4 个基准族 · 4 个指标
browsecomp · browse_comp · z 0.31 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 1.10 · q 1.00
osworld · os_world_verified · z 0.85 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 1.24 · q 1.00
恢复与完成可靠性仅先验
Agentic score
站内排名#11
分数82.4
更新时间2026年9月13日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#9
分数80.4
更新时间2026年9月13日
置信度3
BrowseCompV3 计分证据
站内排名#8
分数84.7
更新时间2026年9月13日
置信度3
OSWorld-VerifiedV3 计分证据
站内排名#6
分数81.2
更新时间2026年9月13日
置信度3
GDPval-AAV3 计分证据
站内排名#10
分数1603.0
更新时间2026年9月13日
置信度3
HLE w/ tools
站内排名#3
分数57.4
更新时间2026年9月13日
置信度3
AA Agentic Index
站内排名#13
分数44.3
更新时间2026年9月13日
置信度3
GDPval-AA
站内排名#13
分数50.0
更新时间2026年9月13日
置信度3
Terminal-Bench 3.0
站内排名#9
分数14.6
更新时间2026年9月13日
置信度3
Terminal-Bench 2.1 (Vals)
站内排名#13
分数74.5
更新时间2026年9月13日
置信度3
AA-AnalystAgent
站内排名#8
分数46.3
更新时间2026年9月13日
置信度3
ApprenticeBench
站内排名#10
分数16.0
更新时间2026年9月13日
置信度3
AA AutomationBench
站内排名#20
分数39.2
更新时间2026年8月20日
置信度2

代码

V3.0

17 个指标 · 正式评分

分数58.5#780% 区间51.9–65.14/4 实测维度SciCode54.3%#18 / 89Coding score59.5#28 / 87
维度与证据
代码生成56.3
1 个基准族 · 1 个指标
scicode · scicode · z 0.67 · q 1.00
仓库工程57.4
1 个基准族 · 1 个指标
swe_pro · swe_pro · z 1.09 · q 1.00
调试与测试63.8
2 个基准族 · 2 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z 0.53 · q 1.00
swe_verified · swe_verified · z 1.94 · q 1.00
工具化开发与质量56.5
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 0.88 · q 1.00
SciCodeV3 计分证据
站内排名#18
分数54.3%
更新时间2026年9月13日
置信度4
Coding score
站内排名#28
分数59.5
更新时间2026年9月13日
置信度3
SWE-bench ProV3 计分证据
站内排名#10
分数63.2
更新时间2026年9月13日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#8
分数80.4
更新时间2026年9月13日
置信度3
FrontierCode 1.1 Main
站内排名#7
分数42.7
更新时间2026年9月13日
置信度3
SWE-bench VerifiedV3 计分证据
站内排名#5
分数85.2
更新时间2026年9月13日
置信度3
SWE MultilingualV3 计分证据
站内排名#5
分数78.3
更新时间2026年9月13日
置信度3
SWE Multimodal
站内排名#4
分数28.1
更新时间2026年9月13日
置信度3
AA Coding Index
站内排名#18
分数71.5
更新时间2026年9月13日
置信度3
AA-SciCodeV3 计分证据
站内排名#22
分数54.3
更新时间2026年9月13日
置信度3
CursorBench v3.2
站内排名#10
分数61.5
更新时间2026年9月13日
置信度3
LiveCodeBench (Vals)
站内排名#28
分数82.4
更新时间2026年9月13日
置信度3
SWE-bench (Vals)
站内排名#21
分数79.6
更新时间2026年9月13日
置信度3
VulcanBench CII v1
站内排名#2
分数89.2
更新时间2026年9月13日
置信度3
APEX-SWE
站内排名#5
分数46.4
更新时间2026年8月20日
置信度2
EEBench
站内排名#7
分数40.3
更新时间2026年8月20日
置信度2
3DCodeBench
站内排名#5
分数39.2
更新时间2026年8月20日
置信度2

综合推理

V3.0

6 个指标 · 估算

分数56.680% 区间45.9–67.42/4 实测维度GPQA91.1%#25 / 218HLE41.3%#27 / 216
维度与证据
抽象逻辑仅先验
科学与因果推理56
3 个基准族 · 4 个指标
critpt · critpt · z 0.71 · q 1.00
gpqa · gpqa · z 0.12 · q 1.00
hle · hle · z 0.31 · q 1.00
hle · hle_no_tools · z 0.06 · q 1.00
多步约束仅先验
证据整合与验证57.2
1 个基准族 · 1 个指标
lcr · lcr · z 0.62 · q 1.00
GPQAV3 计分证据
站内排名#25
分数91.1%
更新时间2026年9月13日
置信度4
HLEV3 计分证据
站内排名#27
分数41.3%
更新时间2026年9月13日
置信度4
AA-LCRV3 计分证据
站内排名#14
分数82.0
更新时间2026年9月13日
置信度3
CritPtV3 计分证据
站内排名#22
分数16.9
更新时间2026年9月13日
置信度3
Reasoning score
站内排名#11
分数77.4
更新时间2026年9月13日
置信度3
MLCR-AA
站内排名#4
分数55.0
更新时间2026年9月13日
置信度3

知识

V3.0

12 个指标 · 暂定评分

分数58.380% 区间44.3–72.31/4 实测维度Knowledge score80.3#13 / 83HLE w/o tools43.2#9 / 22
维度与证据
广泛知识58.3
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.67 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.64 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#13
分数80.3
更新时间2026年9月13日
置信度3
HLE w/o tools
站内排名#9
分数43.2
更新时间2026年9月13日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#32
分数38.4
更新时间2026年9月13日
置信度3
AA-GPQA Diamond
站内排名#25
分数91.1
更新时间2026年9月13日
置信度3
AA-HLE
站内排名#23
分数41.3
更新时间2026年9月13日
置信度3
AA-Omniscience IndexV3 计分证据
站内排名#21
分数16.5
更新时间2026年9月13日
置信度3
AA-Omniscience Accuracy
站内排名#34
分数40.1
更新时间2026年9月13日
置信度3
AA-Omniscience Hallucination Rate
站内排名#87
分数39.4
更新时间2026年9月13日
置信度3
HLE-Verified
站内排名#6
分数31.0
更新时间2026年9月13日
置信度3
LABBench2
站内排名#6
分数80.1
更新时间2026年9月13日
置信度3
GPQA Diamond (Vals)
站内排名#23
分数88.9
更新时间2026年9月13日
置信度3
MMLU-Pro (Vals)
站内排名#22
分数87.5
更新时间2026年9月13日
置信度3

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

5 个指标 · 暂定评分

分数56.380% 区间40.2–72.51/4 实测维度Multimodal Grounded score77.5#16 / 56CharXiv88.3#9 / 30
维度与证据
感知与 OCR仅先验
文档与空间理解56.3
1 个基准族 · 1 个指标
charxiv · charxiv · z 1.00 · q 1.00
视觉推理仅先验
视频与落地行动仅先验
Multimodal Grounded score
站内排名#16
分数77.5
更新时间2026年9月13日
置信度3
CharXivV3 计分证据
站内排名#9
分数88.3
更新时间2026年9月13日
置信度3
CharXiv w/o tools
站内排名#10
分数77.0
更新时间2026年9月13日
置信度3
AA-MMMU-Pro
站内排名#26
分数77.3
更新时间2026年9月13日
置信度3
Design Arena Website
站内排名#19
分数1289.0
更新时间2026年9月13日
置信度3

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

10 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Azure
azure/us
$2/M$10/M100%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/eu-west-1
$2.20/M$11/M100%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/us-east-1
$2.20/M$11/M100%undefined tokens / undefined tokens
Google
google-vertex/us
$2.20/M$11/M100%undefined tokens / undefined tokens
Anthropic
anthropic
$2/M$10/M100.0%undefined tokens / undefined tokens
Claude Platform on AWS
claude-on-aws
$2/M$10/M100.0%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/global
$2/M$10/M100.0%undefined tokens / undefined tokens
Google
google-vertex/europe
$2.20/M$11/M100.0%undefined tokens / undefined tokens
Google
google-vertex/global
$2/M$10/M100.0%undefined tokens / undefined tokens
Azure
azure/global
$2/M$10/M99.7%undefined tokens / undefined tokens

价格对比

对比 Claude Sonnet 5 在 541 家服务商的 API 价格。价格从 $0.010/request 到 $2400.00/M,其中 KFCV50 提供最低价 $0.010/request。 6 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
claude-sonnet-5
claude_kiro
-65%$0.700/M
-65%$3.50/M
L1
100%
claude-sonnet-5
default
-93%$0.137/M
Cache read$0.014/M
-93%$0.685/M
L1
100%
claude-sonnet-5
aws-q
-96%$0.086/M
Cache read$0.0086/M
-96%$0.429/M
L1
100%
claude-sonnet-5
Claude-Corp
-97%$0.068/M
Cache read$0.0068/MCache write$0.084/MCache write 1h$0.135/M
-97%$0.338/M
L1
100%
claude-sonnet-5
default
$0.041/request
-
L1
100%
claude-sonnet-5
CC-KIRO
-97%$0.061/M
Cache read$0.0061/M
-97%$0.307/M
L1
100%
claude-sonnet-5
default
-93%$0.137/M
Cache read$0.014/M
-93%$0.685/M
L1
100%
claude-sonnet-5
default
$3.00/M
Cache read$0.300/M
$15.00/M
L1
100%
claude-sonnet-5
default
$2.30/M
$11.51/M
L1
100%
claude-sonnet-5
default
$0.036/request
-
L1
100%
claude-sonnet-5
Kiro-Claude-1
-97%$0.052/M
Cache read$0.0052/M
-97%$0.262/M
L1
100%
claude-sonnet-5
Claude_AG
-97%$0.058/M
Cache read$0.0058/MCache write$0.072/MCache write 1h$0.115/M
-97%$0.288/M
L1
100%
L2
0%
claude-sonnet-5
Claude_AG
-97%$0.058/M
Cache read$0.0058/MCache write$0.072/MCache write 1h$0.115/M
-97%$0.288/M
L1
100%
claude-sonnet-5
claude
-90%$0.205/M
Cache read$0.021/MCache write$0.257/MCache write 1h$0.411/M
-90%$1.03/M
L1
100%
claude-sonnet-5
claude-标准-个人版
-81%$0.390/M
-81%$1.95/M
L1
100%
claude-sonnet-5
cc-max
-79%$0.411/M
Cache read$0.041/M
-79%$2.05/M
L1
100%
claude-sonnet-5
Claude kiro 智能路由分组
-77%$0.450/M
Cache read$0.045/MCache write$0.563/MCache write 1h$0.900/M
-77%$2.25/M
L1
100%
claude-sonnet-5
claude-kiro-discount
-75%$0.500/M
Cache read$0.050/M
-75%$2.50/M
L1
100%
claude-5-sonnet
default
-73%$0.548/M
-73%$2.74/M
L1
100%
claude-sonnet-5
cc逆向
-60%$0.800/M
Cache read$0.080/MCache write$1.00/MCache write 1h$1.60/M
-60%$4.00/M
当前显示 20 个模型 ID,共 131 个。

替代方案与相似模型

常见问题

Claude Sonnet 5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Claude Sonnet 5 的基准测试、API 价格、输出速度、首字延迟和 547 家服务商数据。
Claude Sonnet 5 API 价格是多少?
Claude Sonnet 5 在 547 家服务商有价格记录,价格从 $0.010/request$2400.00/M。最低价由 KFCV50 提供。
Claude Sonnet 5 API 价格表包含什么?
Claude Sonnet 5 API 价格表会对比 547 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Claude Sonnet 5 API 价格最低?
KFCV50 当前提供 Claude Sonnet 5 的最低收录价格:$0.010/request,共对比 547 家服务商。
可以同时对比 Claude Sonnet 5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Claude Sonnet 5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Claude Sonnet 5 的 API 免费吗?
是的,Claude Sonnet 5 免费 API 可通过 LMSpeed 上的 6 家服务商使用,包括我不是AI神, 兔子API, 我不是AI神, 兔子API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Claude Sonnet 5 免费 API?
LMSpeed 当前收录了 6 家 Claude Sonnet 5 免费 API 服务商,包括我不是AI神, 兔子API, 我不是AI神, 兔子API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Claude-Sonnet-5[hm]q|kiro/claude-sonnet-5[hm]q|薄甲逆/claude-sonnet-5[lq]q|CP/claude-sonnet-5[lq]q|CS/claude-sonnet-5

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档