返回模型目录

Model compare

Claude Opus 4.6 vs Qwen3

Claude Opus 4.6 和 Qwen3 的结论先放在这里,方便先判断是否值得继续看明细。

Key Takeaways

综合加权结果:Claude Opus 4.6。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。

结论

Claude Opus 4.6

Claude Opus 4.6 当前综合加权更高;模型 A / B 得分为 76 对 24。

证据覆盖

84 个数据点

包含 9 个 benchmark、0 个 audit 样本和 9 个 provider 样本。

选择依据

优先看 Claude Opus 4.6

下方图表把 18 组高信号样本拆开,便于核对速度、跑分和安全分。

切换对比模型

左右两边都可以换成其他模型,页面会打开新的 LMSpeed 对比 URL。

选择其他模型后会打开新的对比页。

对比总表

这份报告只使用 LMSpeed 已有数据:Claude Opus 4.6 和 Qwen3 的价格、测速聚合、第三方跑分与共同服务商样本。

Model compare
Claude Opus 4.6
Qwen3
综合领先领先对照
综合加权得分76.0 分24.0 分
Benchmark 分类领先4 类1 类
运营维度优势首 token 延迟、免费服务商、服务商覆盖最低输入价格、平均速度
上下文窗口1M tokens262.1K tokens
最大输出128K tokens16.4K tokens
模态

输入

文本图像文件

输出

文本

输入

文本

输出

文本
能力
文本输入图像输入文件输入文本输出工具调用结构化输出JSON 模式推理
文本输入文本输出工具调用结构化输出JSON 模式

总体结果按 80% benchmark 能力分类和 20% 价格、API 速度/延迟与可用性加权;近期测试数量不参与胜负,缺失的 benchmark 分类不计分。

模型元信息

Model compare
Claude Opus 4.6
Qwen3
开发者Anthropic暂无数据
发布日期2026年2月2025年7月
参数量暂无数据235B / 22B active
TokenizerClaudeQwen3
知识截止暂无数据2025-06-30
OpenRouter IDanthropic/claude-opus-4.6qwen/qwen3-235b-a22b-2507
来源链接暂无数据暂无数据

什么时候选哪个模型

这份报告只使用 LMSpeed 已有数据:Claude Opus 4.6 和 Qwen3 的价格、测速聚合、第三方跑分与共同服务商样本。

Claude Opus 4.6

Claude Opus 4.6 在 benchmark 分类(代码、推理、知识、多语言)和运营维度(首 token 延迟、免费服务商、服务商覆盖)更强。

Qwen3

Qwen3 在 benchmark 分类(数学)和运营维度(最低输入价格、平均速度)更强。

跑分对比

来自 LMSpeed 同步的第三方 benchmark profile;只展示两个模型都有数值的指标。

分类能力对比

按 0-100 分对比 benchmark 分类表现;点击分类可以聚焦查看差距。

模型 A 覆盖
8 / 8
模型 B 覆盖
5 / 8
共同覆盖
5 个共同分类

平均分

Claude Opus 4.6

51.8

平均分

Qwen3

45.5

Agents

Claude Opus 4.6

Claude Opus 4.654.3
Qwen3-

代码

Claude Opus 4.6 领先 8.3

Claude Opus 4.656.6
Qwen348.3

推理

Claude Opus 4.6 领先 5.9

Claude Opus 4.653.4
Qwen347.5

知识

Claude Opus 4.6 领先 16.5

Claude Opus 4.653.3
Qwen336.8

数学

Qwen3 领先 2.6

Claude Opus 4.655.7
Qwen358.3

多语言

Claude Opus 4.6 领先 11.7

Claude Opus 4.648.4
Qwen336.7

多模态

Claude Opus 4.6

Claude Opus 4.647.8
Qwen3-

指令遵循

Claude Opus 4.6

Claude Opus 4.644.8
Qwen3-

专业跑分明细

按具体 benchmark 指标对比两个模型,展示来源、排名覆盖、置信度、误差和评测日期等上下文。

综合reported

BenchLM overall score

Claude Opus 4.6

领先

62.0

排名 #42/112 · confidence 4 · 评测日期 2026-02-01

+9.0

Qwen3

53.0

排名 #75/112 · confidence 1 · 评测日期 2025-07-01

价格verified

Blended price

Claude Opus 4.6

$10.00/M

排名 #169/186 · confidence 4

+$9.65/M

Qwen3

领先

$0.350/M

排名 #35/186 · confidence 4

价格verified

Input price

Claude Opus 4.6

$5.00/M

排名 #168/186 · confidence 4

+$4.80/M

Qwen3

领先

$0.200/M

排名 #35/186 · confidence 4

价格verified

Output price

Claude Opus 4.6

$25.00/M

排名 #169/186 · confidence 4

+$24.20/M

Qwen3

领先

$0.800/M

排名 #36/186 · confidence 4

推理reported

MMLU-Pro

Claude Opus 4.6

领先

82.0%

排名 #50/129 · confidence 4 · 评测日期 2026-02-01

+4.3%

Qwen3

77.7%

排名 #75/129 · confidence 4

Claude Opus 4.6

领先

84.0%

排名 #75/218 · confidence 4

+18.1%

Qwen3

65.9%

排名 #156/218 · confidence 4

Claude Opus 4.6

领先

19.1%

排名 #89/216 · confidence 4

+12.2%

Qwen3

6.9%

排名 #144/216 · confidence 4

知识reported

SuperGPQA

Claude Opus 4.6

领先

95.0

排名 #1/16 · confidence 4 · 评测日期 2026-02-01

+32.4

Qwen3

62.6

排名 #16/16 · confidence 1 · 评测日期 2025-07-01

知识reported

BenchLM Knowledge score

Claude Opus 4.6

领先

79.8

排名 #15/83 · confidence 4 · 评测日期 2026-02-01

+7.5

Qwen3

72.3

排名 #33/83 · confidence 1 · 评测日期 2025-07-01

API audit 对比

来自共同 provider 的最近完成 audit,展示四个安全/完整性分组分数和报告入口。

Provider
Claude Opus 4.6
Qwen3
暂无共同 provider 的已完成 audit。

Provider 数据样本

把同一 provider 的测速聚合和 input/output 价格放进同一行,便于判断实际 API 表现和迁移成本。

Provider
Claude Opus 4.6
Qwen3
OpenRouter65 次测试

Claude Opus 4.6

speed / latency

N/A / N/A

input / output

暂无数据

Qwen3

speed / latency

88 tok/s / 14234ms

input / output

暂无数据

RinkoAI45 次测试

Claude Opus 4.6

speed / latency

N/A / N/A

input / output

暂无数据

Qwen3

speed / latency

285 tok/s / 3763ms

input / output

暂无数据

钠 API20 次测试

Claude Opus 4.6

speed / latency

42 tok/s / 2282ms

input / output

暂无数据

Qwen3

speed / latency

N/A / N/A

input / output

暂无数据

ModelPool15 次测试

Claude Opus 4.6

claude-opus-4-6

speed / latency

84 tok/s / 3916ms

input / output

$0.286/M/$1.43/M

Qwen3

qwen3-4b

speed / latency

76 tok/s / 983ms

input / output

$0.0055/M/$0.022/M

Rnglg2 API15 次测试

Claude Opus 4.6

speed / latency

57 tok/s / 3926ms

input / output

暂无数据

Qwen3

speed / latency

N/A / N/A

input / output

暂无数据

Claude Opus 4.6

anthropic/claude-opus-4.6

speed / latency

暂无数据

input / output

$0.589/M/$2.88/M

Qwen3

qwen3-235b

speed / latency

暂无数据

input / output

$0/M/$0/M

Claude Opus 4.6

claude-opus-4-6

speed / latency

暂无数据

input / output

$0/request

Qwen3

qwen3-8b

speed / latency

暂无数据

input / output

$0/request

Claude Opus 4.6

claude-opus-4-6

speed / latency

暂无数据

input / output

$0.773/M/$3.87/M

Qwen3

Qwen/Qwen3-8B

speed / latency

暂无数据

input / output

$0.00000186/M/$0.00000722/M

Claude Opus 4.6

claude-opus-4-6-20260101

speed / latency

暂无数据

input / output

$1.50/M/$7.50/M

Qwen3

qwen3-4b

speed / latency

暂无数据

input / output

$0.011/M/$0.034/M

常见问题

综合加权结果:Claude Opus 4.6。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。

这个比较为什么能收录?
它至少有 6 个可验证比较点,并且两个模型都有价格或测速数据。
没有数据的指标会不会编?
不会。没有 LMSpeed 数据的指标不会出现在这份报告里。

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。