Qwen
·Released on 2026年5月21日

Qwen3.7 Max API 基准测试 价格和服务商数据

选择与 Qwen3.7 Max 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Qwen3.7 Max 页面汇总基准测试、API 价格和服务商数据,覆盖 100 家服务商,价格从 $0.0030/request 起。Qwen3.7 Max 免费 API 额度来自 1 家服务商。页面同时展示实测速度和首字延迟。

Qwen3.7-Max is the flagship model in Alibaba's Qwen3.7 series. It supports text input and output and is designed for agent-centric workloads, with particular strengths in coding, office and productivi...

质量
#8of 100
76.0
LMSpeed 评分
速度
111char/s
22.62 s
成本
#150of 180
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体56.9代码57综合推理59.6知识55.8数学62.2多语言58.1多模态-指令遵循56.8
#1数学62.2估算2/4 实测维度
80% 区间: 50.074.4
foundational math仅先验
competition math68
hmmt · hmmt_feb2026
proof frontier56.3
imo · imo_answer_bench
applied tool math仅先验
#2综合推理59.6正式评分全站排名 #53/4 实测维度
80% 区间: 51.068.3
abstract logic仅先验
scientific causal62
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints61.8
mmlu_pro · mmlu_pro
evidence verification55.1
lcr · lcr
#3多语言58.1估算2/4 实测维度
80% 区间: 46.569.8
cross language understanding52.9
include · include / nova · nova63
multilingual generation仅先验
reasoning transfer63.4
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#4代码57正式评分全站排名 #114/4 实测维度
80% 区间: 51.063.0
code generation61.8
livecodebench · livecodebench / scicode · scicode
repository engineering56.2
nl2repo · nl2_repo / swe_pro · swe_pro
debugging testing59.1
swe_multilingual · benchlm_coding_swe_multilingual / swe_verified · swe_verified
tooling quality50.8
terminalbench · benchlm_coding_terminal_bench2
#5智能体56.9正式评分全站排名 #184/4 实测维度
80% 区间: 51.062.7
planning57.9
deep_planning · gert_labs
tool use57.6
mcp_atlas · mcp_atlas / tau · tau2_bench
environment execution55.1
gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2 / vita_bench · vita_bench
recovery reliability56.9
claw_eval · claw_eval / researchclaw · research_claw_bench
#6指令遵循56.8估算2/4 实测维度
80% 区间: 44.968.7
constraint following57
ifeval · ifeval
structured output仅先验
novel instruction generalization56.6
ifbench · aa_if_bench
long multiturn instruction仅先验
#7知识55.8估算2/4 实测维度
80% 区间: 43.668.0
broad knowledge57
mmlu_redux · mmlu_redux
professional knowledge54.6
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
暂无数据:多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
131.1Ktokens
8K128K1M4M
1M

能力

Technical Details

输入
输出
发布日期
May 2026
官方文档
Tokenizer
Qwen
架构
text->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月31日

综合

1 个指标

Overall score76.0#8 / 100
Overall score
站内排名#8
分数76.0
更新时间2026年8月31日
置信度4

价格

2 个指标

输入价格$2.50/M#150 / 180输出价格$7.50/M#131 / 180
输入价格
Input price
站内排名#150
分数$2.50/M
更新时间2026年8月31日
置信度4
输出价格
Output price
站内排名#131
分数$7.50/M
更新时间2026年8月31日
置信度4

智能体

V3.0

15 个指标 · 正式评分

分数56.9#1880% 区间51.0–62.74/4 实测维度Agentic score64.1#32 / 69Terminal-Bench 2.069.7#17 / 53
维度与证据
规划拆解57.9
1 个基准族 · 1 个指标
deep_planning · gert_labs · z 1.07 · q 1.00
工具调用57.6
2 个基准族 · 2 个指标
mcp_atlas · mcp_atlas · z 0.30 · q 1.00
tau · tau2_bench · z 0.58 · q 1.00
环境与长程执行55.1
3 个基准族 · 3 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.29 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.39 · q 1.00
vita_bench · vita_bench · z 0.55 · q 1.00
恢复与完成可靠性56.9
2 个基准族 · 2 个指标
claw_eval · claw_eval · z 0.94 · q 1.00
researchclaw · research_claw_bench · z 0.21 · q 1.00
Agentic score
站内排名#32
分数64.1
更新时间2026年8月31日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#17
分数69.7
更新时间2026年8月31日
置信度4
QwenClawBench
站内排名#1
分数64.3
更新时间2026年8月31日
置信度4
QwenWebBench
站内排名#1
分数1568.0
更新时间2026年8月31日
置信度4
Claw-EvalV3 计分证据
站内排名#7
分数65.2
更新时间2026年8月31日
置信度4
BFCL v4
站内排名#1
分数75.0
更新时间2026年8月31日
置信度4
MCP AtlasV3 计分证据
站内排名#9
分数76.4
更新时间2026年8月31日
置信度4
VITA-BenchV3 计分证据
站内排名#1
分数47.9
更新时间2026年8月31日
置信度4
HLE w/ tools
站内排名#5
分数53.5
更新时间2026年8月31日
置信度4
AA Agentic Index
站内排名#30
分数30.9
更新时间2026年8月31日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#22
分数94.7
更新时间2026年8月31日
置信度4
GDPval-AA
站内排名#25
分数38.3
更新时间2026年8月31日
置信度4
GDPval-AAV3 计分证据
站内排名#24
分数1267.0
更新时间2026年8月31日
置信度4
Gert LabsV3 计分证据
站内排名#5
分数64.3
更新时间2026年8月31日
置信度4
ResearchClawBenchV3 计分证据
站内排名#6
分数18.7
更新时间2026年8月31日
置信度4

代码

V3.0

12 个指标 · 正式评分

分数57#1180% 区间51.0–63.04/4 实测维度LiveCodeBench91.6%#1 / 115SciCode48.8%#29 / 205
维度与证据
代码生成61.8
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 1.61 · q 1.00
scicode · scicode · z 0.97 · q 1.00
仓库工程56.2
2 个基准族 · 2 个指标
nl2repo · nl2_repo · z 0.83 · q 1.00
swe_pro · swe_pro · z 0.71 · q 1.00
调试与测试59.1
2 个基准族 · 2 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z 0.78 · q 1.00
swe_verified · swe_verified · z 0.75 · q 1.00
工具化开发与质量50.8
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 0.11 · q 1.00
LiveCodeBenchV3 计分证据
站内排名#1
分数91.6%
更新时间2026年8月31日
置信度4
SciCodeV3 计分证据
站内排名#29
分数48.8%
更新时间2026年8月31日
置信度4
Coding score
站内排名#3
分数79.5
更新时间2026年8月31日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#11
分数80.4
更新时间2026年8月31日
置信度4
SWE-bench ProV3 计分证据
站内排名#14
分数60.6
更新时间2026年8月31日
置信度4
SWE MultilingualV3 计分证据
站内排名#4
分数78.3
更新时间2026年8月31日
置信度4
NL2RepoV3 计分证据
站内排名#5
分数47.2
更新时间2026年8月31日
置信度4
SciCodeV3 计分证据
站内排名#1
分数53.5
更新时间2026年8月31日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#14
分数69.7
更新时间2026年8月31日
置信度4
AA Coding Index
站内排名#24
分数66.0
更新时间2026年8月31日
置信度4
AA-SciCodeV3 计分证据
站内排名#34
分数48.8
更新时间2026年8月31日
置信度4
OpenHarmony Bench
站内排名#4
分数53.4
更新时间2026年8月31日
置信度4

综合推理

V3.0

7 个指标 · 正式评分

分数59.6#580% 区间51.0–68.33/4 实测维度MMLU-Pro89.6%#1 / 129GPQA92.3%#15 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理62
3 个基准族 · 3 个指标
critpt · critpt · z 0.69 · q 1.00
gpqa · gpqa · z 1.20 · q 1.00
hle · hle · z 0.95 · q 1.00
多步约束61.8
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 1.37 · q 1.00
证据整合与验证55.1
1 个基准族 · 1 个指标
lcr · lcr · z 0.32 · q 1.00
MMLU-ProV3 计分证据
站内排名#1
分数89.6%
更新时间2026年8月31日
置信度4
GPQAV3 计分证据
站内排名#15
分数92.3%
更新时间2026年8月31日
置信度4
HLEV3 计分证据
站内排名#26
分数40.5%
更新时间2026年8月31日
置信度4
Reasoning score
站内排名#8
分数78.0
更新时间2026年8月31日
置信度4
MRCRv2
站内排名#3
分数90.4
更新时间2026年8月31日
置信度4
CritPtV3 计分证据
站内排名#24
分数13.4
更新时间2026年8月31日
置信度4
AA-LCRV3 计分证据
站内排名#30
分数74.7
更新时间2026年8月31日
置信度4

知识

V3.0

11 个指标 · 估算

分数55.880% 区间43.6–68.02/4 实测维度Knowledge score70.2#29 / 69GPQA-D92.4#11 / 31
维度与证据
广泛知识57
1 个基准族 · 1 个指标
mmlu_redux · mmlu_redux · z 0.86 · q 0.75
专业知识54.6
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z 0.87 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#29
分数70.2
更新时间2026年8月31日
置信度4
GPQA-D
站内排名#11
分数92.4
更新时间2026年8月31日
置信度4
MMLU-ReduxV3 计分证据
站内排名#2
分数95.0
更新时间2026年8月31日
置信度4
SuperGPQAV3 计分证据
站内排名#4
分数73.6
更新时间2026年8月31日
置信度4
MMMLU
站内排名#1
分数90.3
更新时间2026年8月31日
置信度4
Artificial Analysis Intelligence Index
站内排名#24
分数46.7
更新时间2026年8月31日
置信度4
AA-GPQA Diamond
站内排名#15
分数92.3
更新时间2026年8月31日
置信度4
AA-HLE
站内排名#23
分数40.5
更新时间2026年8月31日
置信度4
AA-Omniscience Index
站内排名#20
分数13.5
更新时间2026年8月31日
置信度4
AA-Omniscience Accuracy
站内排名#49
分数31.1
更新时间2026年8月31日
置信度4
AA-Omniscience Hallucination Rate
站内排名#97
分数25.6
更新时间2026年8月31日
置信度4

数学

V3.0

4 个指标 · 估算

分数62.280% 区间50.0–74.42/4 实测维度HMMT Feb 202697.1#1 / 18IMOAnswerBench90.0#1 / 7
维度与证据
基础数学仅先验
竞赛数学68
1 个基准族 · 1 个指标
hmmt · hmmt_feb2026 · z 2.54 · q 1.00
高阶证明56.3
1 个基准族 · 1 个指标
imo · imo_answer_bench · z 0.36 · q 0.88
应用与工具辅助数学仅先验
HMMT Feb 2026V3 计分证据
站内排名#1
分数97.1
更新时间2026年8月31日
置信度4
IMOAnswerBenchV3 计分证据
站内排名#1
分数90.0
更新时间2026年8月31日
置信度4
Apex
站内排名#1
分数44.5
更新时间2026年8月31日
置信度4
Math score
站内排名#4
分数82.2
更新时间2026年8月31日
置信度4

多语言

V3.0

6 个指标 · 估算

分数58.180% 区间46.5–69.82/4 实测维度Multilingual score100.0#1 / 11MMLU-ProX87.0#1 / 11
维度与证据
跨语言理解52.9
2 个基准族 · 2 个指标
include · include · z -0.35 · q 0.33
nova · nova63 · z 0.59 · q 0.88
多语言生成仅先验
推理迁移63.4
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z 1.99 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#1
分数100.0
更新时间2026年8月31日
置信度4
MMLU-ProXV3 计分证据
站内排名#1
分数87.0
更新时间2026年8月31日
置信度4
NOVA-63V3 计分证据
站内排名#2
分数59.0
更新时间2026年8月31日
置信度4
INCLUDEV3 计分证据
站内排名#3
分数86.2
更新时间2026年8月31日
置信度4
MAXIFE
站内排名#1
分数89.2
更新时间2026年8月31日
置信度4
PolyMath
站内排名#1
分数86.5
更新时间2026年8月31日
置信度4

多模态

V3.0

1 个指标 · 暂无数据

80% 区间30.8–69.20/4 实测维度Design Arena Website1293.0#17 / 75
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
Design Arena Website
站内排名#17
分数1293.0
更新时间2026年8月31日
置信度4

指令遵循

V3.0

4 个指标 · 估算

分数56.880% 区间44.9–68.72/4 实测维度Instruction Following score91.0#6 / 25IFEval94.3#3 / 16
维度与证据
约束遵循57
1 个基准族 · 1 个指标
ifeval · ifeval · z 0.73 · q 1.00
结构化输出仅先验
新指令泛化56.6
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.61 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#6
分数91.0
更新时间2026年8月31日
置信度4
IFEvalV3 计分证据
站内排名#3
分数94.3
更新时间2026年8月31日
置信度4
IFBenchV3 计分证据
站内排名#6
分数79.1
更新时间2026年8月31日
置信度4
AA-IFBenchV3 计分证据
站内排名#3
分数80.5
更新时间2026年8月31日
置信度4

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Alibaba
alibaba
$1.48/M$4.42/M100.0%undefined tokens / undefined tokens

价格对比

对比 Qwen3.7 Max 在 99 家服务商的 API 价格。价格从 $0.0030/request 到 $1095.00/M,其中 Crond 提供最低价 $0.0030/request。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
99%
qwen3.7-max
default
-40%$1.50/M
Cache read$0.300/M
-40%$4.50/M
77.5 t/s
14.81 s
L1
100%
qwen3.7-max
default
-67%$0.822/M
-67%$2.47/M
L1
100%
qwen3.7-max
bailian
-66%$0.857/M
Cache read$0.171/M
-66%$2.57/M
L1
100%
qwen3.7-max
default
$6.00/M
$18.00/M
L1
100%
qwen3.7-max
default
-73%$0.685/M
Cache read$0.068/M
-73%$2.05/M
L1
100%
qwen3.7-max
default
-47%$1.32/M
-47%$3.95/M
L1
100%
qwen3.7-max
default
-20%$2.00/M
-73%$2.00/M
L1
100%
qwen3.7-max
default
$12.00/M
Cache read$1.20/M
$36.00/M
L1
99%
qwen/qwen3.7-max
other
-58%$1.04/M
Cache read$0.208/M
-58%$3.12/M
L1
100%
qwen/qwen3.7-max
default
-50%$1.25/M
-50%$3.75/M
L1
100%
qwen3.7-max
default
-14%$2.16/M
-14%$6.48/M
L1
100%
qwen3.7-max
ALIYUN
$41.25/M
$41.25/M
L1
100%
L2
62%
qwen3.7-max
default
$75.00/M
$75.00/M
L1
99%
qwen3.7-max
qwen-new
-41%$1.48/M
Cache read$0.148/MCache write$1.85/MCache write 1h$2.96/M
-41%$4.44/M
L1
99%
qwen3.7-max-2026-05-20
qwen-new
-41%$1.48/M
-41%$4.44/M
L1
100%
qwen3.7-max
default
$1095.00/M
$1095.00/M
L1
100%
qwen3.7-max
default
-93%$0.171/M
Cache read$0.034/M
-93%$0.514/M
L1
99%
qwen3.7-max
default
-47%$1.32/M
-47%$3.95/M
L1
99%
qwen3.7-max
default
-34%$1.64/M
-34%$4.93/M
L1
99%
qwen3.7-max
default
$5.87/M
Cache read$0.587/MCache write$7.34/MCache write 1h$11.75/M
$17.62/M
当前显示 20 个模型 ID,共 45 个。

替代方案与相似模型

常见问题

Qwen3.7 Max 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Qwen3.7 Max 的基准测试、API 价格、输出速度、首字延迟和 100 家服务商数据。
Qwen3.7 Max API 价格是多少?
Qwen3.7 Max100 家服务商有价格记录,价格从 $0.0030/request $1095.00/M。最低价由 Crond 提供。
Qwen3.7 Max API 价格表包含什么?
Qwen3.7 Max API 价格表会对比 100 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Qwen3.7 Max API 价格最低?
Crond 当前提供 Qwen3.7 Max 的最低收录价格:$0.0030/request,共对比 100 家服务商。
可以同时对比 Qwen3.7 Max API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Qwen3.7 Max API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Qwen3.7 Max 的 API 免费吗?
是的,Qwen3.7 Max 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Zero API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Qwen3.7 Max 免费 API?
LMSpeed 当前收录了 1 家 Qwen3.7 Max 免费 API 服务商,包括Zero API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Qwen-Ambassador/Qwen3.7-MaxQwen/Qwen3.7-MaxQwen3.7-Maxqwen/qwen3.7-maxqwen3-7-max

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档