Qwen
·Released on 2026年6月3日

Qwen3.7 Plus API 基准测试 价格和服务商数据

选择与 Qwen3.7 Plus 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Qwen3.7 Plus 页面汇总基准测试、API 价格和服务商数据,覆盖 96 家服务商,价格从 $0.015/request 起。Qwen3.7 Plus 免费 API 额度来自 1 家服务商。页面同时展示实测速度和首字延迟。

Qwen3.7-Plus is a cost-effective model in Alibaba's Qwen3.7 series. It supports text and image input with text output, building on the series' text capabilities with a comprehensive upgrade to its...

质量
#27of 111
67.0
LMSpeed 评分
速度
#62of 81
80char/s
28.78 s
成本
#75of 186
$0.015/ 1M · 8:1 in:out
$0.0023 in · $0.012 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
8 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体53代码52.2综合推理57.3知识48.5数学55.2多语言51.1多模态54.7指令遵循56.9
#1综合推理57.3正式评分全站排名 #123/4 实测维度
80% 区间: 48.665.9
abstract logic仅先验
scientific causal59.2
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints60.3
mmlu_pro · mmlu_pro
evidence verification52.4
lcr · lcr
#2指令遵循56.9估算2/4 实测维度
80% 区间: 45.068.8
constraint following58.1
ifeval · ifeval
structured output仅先验
novel instruction generalization55.6
ifbench · aa_if_bench
long multiturn instruction仅先验
#3数学55.2估算2/4 实测维度
80% 区间: 43.067.3
foundational math仅先验
competition math56.6
hmmt · hmmt_feb2026
proof frontier53.7
imo · imo_answer_bench
applied tool math仅先验
#4多模态54.7正式评分全站排名 #34/4 实测维度
80% 区间: 48.461.0
perception ocr59.7
simplevqa · simple_vqa
document spatial53.4
charxiv · charxiv
visual reasoning56.7
erqa · erqa / mathvision · math_vision / medxpert · med_xpert_qa_mm / mmmu_pro · mmmu_pro
video action49
screenspot · screen_spot_pro / video_mmmu · video_mmmu
#5智能体53正式评分全站排名 #294/4 实测维度
80% 区间: 47.358.8
planning56.8
deep_planning · deep_planning
tool use54.9
mcp_atlas · mcp_atlas / tau · tau2_bench
environment execution48.9
gdpval_aa · benchlm_agentic_gdpval_aa / osworld · os_world2 / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2 / vita_bench · vita_bench
recovery reliability51.5
apex_agents · apex_agents_aa / claw_eval · claw_eval
#6代码52.2正式评分全站排名 #204/4 实测维度
80% 区间: 46.258.2
code generation58
livecodebench · livecodebench / scicode · scicode
repository engineering47.6
nl2repo · nl2_repo / swe_pro · swe_pro
debugging testing52.1
swe_multilingual · benchlm_coding_swe_multilingual / swe_verified · swe_verified
tooling quality51
terminalbench · benchlm_coding_terminal_bench2
#7多语言51.1估算2/4 实测维度
80% 区间: 39.562.8
cross language understanding45.4
include · include / nova · nova63
multilingual generation仅先验
reasoning transfer56.9
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#8知识48.5估算2/4 实测维度
80% 区间: 36.460.7
broad knowledge46.4
mmlu_redux · mmlu_redux
professional knowledge50.7
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
131.1Ktokens
8K128K1M4M
1M

能力

Technical Details

输入
输出
发布日期
Jun 2026
官方文档
Tokenizer
Qwen
架构
text+image->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月11日

综合

1 个指标

Overall score67.0#27 / 111
Overall score
站内排名#27
分数67.0
更新时间2026年9月10日
置信度4

速度与延迟

2 个指标

输出速度60.8 tok/s#62 / 81首字延迟1.46 s#44 / 81
输出速度
Output speed
站内排名#62
分数60.8 tok/s
更新时间2026年9月11日
置信度4
首字延迟
Time to first token
站内排名#44
分数1.46 s
更新时间2026年9月11日
置信度4

价格

2 个指标

输入价格$0.400/M#75 / 186输出价格$1.60/M#68 / 186
输入价格
Input price
站内排名#75
分数$0.400/M
更新时间2026年9月11日
置信度4
输出价格
Output price
站内排名#68
分数$1.60/M
更新时间2026年9月11日
置信度4

智能体

V3.0

18 个指标 · 正式评分

分数53#2980% 区间47.3–58.84/4 实测维度Agentic score58.1#44 / 76Terminal-Bench 2.070.3#15 / 53
维度与证据
规划拆解56.8
1 个基准族 · 1 个指标
deep_planning · deep_planning · z 0.93 · q 1.00
工具调用54.9
2 个基准族 · 2 个指标
mcp_atlas · mcp_atlas · z -0.02 · q 1.00
tau · tau2_bench · z 0.43 · q 1.00
环境与长程执行48.9
4 个基准族 · 5 个指标
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.70 · q 1.00
osworld · os_world2 · z -1.45 · q 1.00
osworld · os_world_verified · z 0.02 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.43 · q 1.00
vita_bench · vita_bench · z 0.45 · q 1.00
恢复与完成可靠性51.5
2 个基准族 · 2 个指标
apex_agents · apex_agents_aa · z -0.17 · q 1.00
claw_eval · claw_eval · z 0.51 · q 1.00
Agentic score
站内排名#44
分数58.1
更新时间2026年9月10日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#15
分数70.3
更新时间2026年9月10日
置信度4
QwenClawBench
站内排名#2
分数61.8
更新时间2026年9月10日
置信度4
QwenWebBench
站内排名#2
分数1536.0
更新时间2026年9月10日
置信度4
Claw-EvalV3 计分证据
站内排名#9
分数62.7
更新时间2026年9月10日
置信度4
BFCL v4
站内排名#3
分数72.9
更新时间2026年9月10日
置信度4
MCP AtlasV3 计分证据
站内排名#17
分数73.2
更新时间2026年9月10日
置信度4
VITA-BenchV3 计分证据
站内排名#2
分数45.6
更新时间2026年9月10日
置信度4
DeepPlanningV3 计分证据
站内排名#1
分数62.3
更新时间2026年9月10日
置信度4
OSWorld-VerifiedV3 计分证据
站内排名#13
分数73.3
更新时间2026年9月10日
置信度4
AndroidWorld
站内排名#3
分数81.0
更新时间2026年9月10日
置信度4
AA Agentic Index
站内排名#49
分数19.7
更新时间2026年9月10日
置信度4
APEX-Agents-AAV3 计分证据
站内排名#14
分数22.4
更新时间2026年9月10日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#29
分数93.0
更新时间2026年9月10日
置信度4
GDPval-AA
站内排名#56
分数19.3
更新时间2026年9月10日
置信度4
GDPval-AAV3 计分证据
站内排名#57
分数886.0
更新时间2026年9月10日
置信度4
OSWorld 2.0V3 计分证据
站内排名#19
分数2.8
更新时间2026年9月10日
置信度4
Terminal-Bench 2.1 (Vals)
站内排名#35
分数52.8
更新时间2026年9月10日
置信度4

代码

V3.0

11 个指标 · 正式评分

分数52.2#2080% 区间46.2–58.24/4 实测维度LiveCodeBench89.6%#3 / 115SciCode46.1%#44 / 89
维度与证据
代码生成58
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 1.45 · q 1.00
scicode · scicode · z 0.28 · q 1.00
仓库工程47.6
2 个基准族 · 2 个指标
nl2repo · nl2_repo · z -0.21 · q 1.00
swe_pro · swe_pro · z 0.09 · q 1.00
调试与测试52.1
2 个基准族 · 2 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z -0.04 · q 1.00
swe_verified · swe_verified · z 0.18 · q 1.00
工具化开发与质量51
1 个基准族 · 1 个指标
terminalbench · benchlm_coding_terminal_bench2 · z 0.15 · q 1.00
LiveCodeBenchV3 计分证据
站内排名#3
分数89.6%
更新时间2026年9月10日
置信度4
SciCodeV3 计分证据
站内排名#44
分数46.1%
更新时间2026年9月11日
置信度4
Coding score
站内排名#31
分数57.9
更新时间2026年9月10日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#12
分数70.3
更新时间2026年9月10日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#22
分数77.7
更新时间2026年9月10日
置信度4
SWE-bench ProV3 计分证据
站内排名#22
分数57.6
更新时间2026年9月10日
置信度4
SWE MultilingualV3 计分证据
站内排名#12
分数75.8
更新时间2026年9月10日
置信度4
NL2RepoV3 计分证据
站内排名#12
分数41.1
更新时间2026年9月10日
置信度4
SciCodeV3 计分证据
站内排名#4
分数51.3
更新时间2026年9月10日
置信度4
AA Coding Index
站内排名#38
分数55.9
更新时间2026年9月10日
置信度4
AA-SciCodeV3 计分证据
站内排名#53
分数46.1
更新时间2026年9月10日
置信度4

综合推理

V3.0

7 个指标 · 正式评分

分数57.3#1280% 区间48.6–65.93/4 实测维度MMLU-Pro88.5%#5 / 129GPQA90.0%#34 / 218
维度与证据
抽象逻辑仅先验
科学与因果推理59.2
3 个基准族 · 3 个指标
critpt · critpt · z 0.44 · q 1.00
gpqa · gpqa · z 0.88 · q 1.00
hle · hle · z 0.74 · q 1.00
多步约束60.3
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 1.17 · q 1.00
证据整合与验证52.4
1 个基准族 · 1 个指标
lcr · lcr · z -0.03 · q 1.00
MMLU-ProV3 计分证据
站内排名#5
分数88.5%
更新时间2026年9月10日
置信度4
GPQAV3 计分证据
站内排名#34
分数90.0%
更新时间2026年9月11日
置信度4
HLEV3 计分证据
站内排名#41
分数35.6%
更新时间2026年9月11日
置信度4
Reasoning score
站内排名#28
分数74.0
更新时间2026年9月10日
置信度4
CritPtV3 计分证据
站内排名#36
分数9.1
更新时间2026年9月10日
置信度4
MRCRv2
站内排名#2
分数91.7
更新时间2026年9月10日
置信度4
AA-LCRV3 计分证据
站内排名#56
分数73.0
更新时间2026年9月10日
置信度4

知识

V3.0

11 个指标 · 估算

分数48.580% 区间36.4–60.72/4 实测维度Knowledge score59.3#59 / 83GPQA-D90.3#16 / 32
维度与证据
广泛知识46.4
1 个基准族 · 1 个指标
mmlu_redux · mmlu_redux · z -0.56 · q 0.75
专业知识50.7
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z 0.36 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#59
分数59.3
更新时间2026年9月10日
置信度4
GPQA-D
站内排名#16
分数90.3
更新时间2026年9月10日
置信度4
MMLU-ReduxV3 计分证据
站内排名#4
分数94.5
更新时间2026年9月10日
置信度4
SuperGPQAV3 计分证据
站内排名#6
分数71.4
更新时间2026年9月10日
置信度4
MMMLU
站内排名#2
分数89.0
更新时间2026年9月10日
置信度4
Artificial Analysis Intelligence Index
站内排名#62
分数25.8
更新时间2026年9月10日
置信度4
AA-GPQA Diamond
站内排名#34
分数90.0
更新时间2026年9月10日
置信度4
AA-HLE
站内排名#38
分数35.6
更新时间2026年9月10日
置信度4
AA-Omniscience Index
站内排名#39
分数1.1
更新时间2026年9月10日
置信度4
AA-Omniscience Accuracy
站内排名#82
分数22.5
更新时间2026年9月10日
置信度4
AA-Omniscience Hallucination Rate
站内排名#100
分数27.7
更新时间2026年9月10日
置信度4

数学

V3.0

4 个指标 · 估算

分数55.280% 区间43.0–67.32/4 实测维度HMMT Feb 202692.9#5 / 18IMOAnswerBench86.0#5 / 7
维度与证据
基础数学仅先验
竞赛数学56.6
1 个基准族 · 1 个指标
hmmt · hmmt_feb2026 · z 1.02 · q 1.00
高阶证明53.7
1 个基准族 · 1 个指标
imo · imo_answer_bench · z 0.00 · q 0.88
应用与工具辅助数学仅先验
HMMT Feb 2026V3 计分证据
站内排名#5
分数92.9
更新时间2026年9月10日
置信度4
IMOAnswerBenchV3 计分证据
站内排名#5
分数86.0
更新时间2026年9月10日
置信度4
Apex
站内排名#5
分数22.7
更新时间2026年9月10日
置信度4
Math score
站内排名#12
分数78.3
更新时间2026年9月10日
置信度4

多语言

V3.0

6 个指标 · 估算

分数51.180% 区间39.5–62.82/4 实测维度Multilingual score78.9#3 / 11MMLU-ProX85.4#3 / 11
维度与证据
跨语言理解45.4
2 个基准族 · 2 个指标
include · include · z -1.73 · q 0.33
nova · nova63 · z 0.48 · q 0.88
多语言生成仅先验
推理迁移56.9
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z 1.12 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#3
分数78.9
更新时间2026年9月10日
置信度4
MMLU-ProXV3 计分证据
站内排名#3
分数85.4
更新时间2026年9月10日
置信度4
NOVA-63V3 计分证据
站内排名#3
分数58.8
更新时间2026年9月10日
置信度4
INCLUDEV3 计分证据
站内排名#4
分数83.0
更新时间2026年9月10日
置信度4
MAXIFE
站内排名#2
分数88.8
更新时间2026年9月10日
置信度4
PolyMath
站内排名#2
分数84.0
更新时间2026年9月10日
置信度4

多模态

V3.0

18 个指标 · 正式评分

分数54.7#380% 区间48.4–61.04/4 实测维度Multimodal Grounded score72.5#22 / 56MMMU-Pro79.0#13 / 31
维度与证据
感知与 OCR59.7
1 个基准族 · 1 个指标
simplevqa · simple_vqa · z 1.31 · q 1.00
文档与空间理解53.4
1 个基准族 · 1 个指标
charxiv · charxiv · z 0.60 · q 1.00
视觉推理56.7
4 个基准族 · 4 个指标
erqa · erqa · z 0.67 · q 1.00
mathvision · math_vision · z 1.04 · q 1.00
medxpert · med_xpert_qa_mm · z -0.33 · q 0.75
mmmu_pro · mmmu_pro · z 0.12 · q 1.00
视频与落地行动49
2 个基准族 · 2 个指标
screenspot · screen_spot_pro · z -0.23 · q 1.00
video_mmmu · video_mmmu · z 0.52 · q 1.00
Multimodal Grounded score
站内排名#22
分数72.5
更新时间2026年9月10日
置信度4
MMMU-ProV3 计分证据
站内排名#13
分数79.0
更新时间2026年9月10日
置信度4
MathVisionV3 计分证据
站内排名#3
分数90.3
更新时间2026年9月10日
置信度4
CharXivV3 计分证据
站内排名#10
分数85.9
更新时间2026年9月10日
置信度4
ERQAV3 计分证据
站内排名#2
分数69.8
更新时间2026年9月10日
置信度4
MedXpertQA (MM)V3 计分证据
站内排名#4
分数71.0
更新时间2026年9月10日
置信度4
ScreenSpot ProV3 计分证据
站内排名#7
分数79.0
更新时间2026年9月10日
置信度4
SimpleVQAV3 计分证据
站内排名#1
分数81.7
更新时间2026年9月10日
置信度4
MMSearch-Plus
站内排名#1
分数41.4
更新时间2026年9月10日
置信度4
RealWorldQA
站内排名#2
分数86.9
更新时间2026年9月10日
置信度4
OmniDocBench 1.5
站内排名#3
分数91.4
更新时间2026年9月10日
置信度4
OCRBench V2
站内排名#2
分数70.7
更新时间2026年9月10日
置信度4
ODINW13
站内排名#1
分数51.1
更新时间2026年9月10日
置信度4
Video-MME (with subtitle)
站内排名#2
分数88.0
更新时间2026年9月10日
置信度4
VideoMMMUV3 计分证据
站内排名#4
分数85.4
更新时间2026年9月10日
置信度4
MLVU (M-Avg)
站内排名#2
分数87.4
更新时间2026年9月10日
置信度4
AA-MMMU-Pro
站内排名#11
分数80.5
更新时间2026年9月10日
置信度4
Design Arena Website
站内排名#23
分数1283.0
更新时间2026年9月10日
置信度4

指令遵循

V3.0

4 个指标 · 估算

分数56.980% 区间45.0–68.82/4 实测维度Instruction Following score91.1#12 / 52IFEval94.6#2 / 16
维度与证据
约束遵循58.1
1 个基准族 · 1 个指标
ifeval · ifeval · z 0.88 · q 1.00
结构化输出仅先验
新指令泛化55.6
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.46 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#12
分数91.1
更新时间2026年9月10日
置信度4
IFEvalV3 计分证据
站内排名#2
分数94.6
更新时间2026年9月10日
置信度4
IFBenchV3 计分证据
站内排名#6
分数79.1
更新时间2026年9月10日
置信度4
AA-IFBenchV3 计分证据
站内排名#5
分数78.0
更新时间2026年9月10日
置信度4

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Alibaba
alibaba
$0.320/M$1.28/M100.0%undefined tokens / undefined tokens

价格对比

对比 Qwen3.7 Plus 在 95 家服务商的 API 价格。价格从 $0.015/request 到 $300.00/M,其中 VSLLM 提供最低价 $0.015/request。 1 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
qwen3.7-plus
default
-66%$0.137/M
Cache read$0.027/M
-66%$0.548/M
L1
100%
qwen3.7-plus
bailian
-64%$0.143/M
Cache read$0.029/M
-64%$0.571/M
L1
100%
qwen3.7-plus
qwen
$0.800/M
$3.20/M
L1
100%
qwen3.7-plus
default
-45%$0.219/M
-45%$0.877/M
L1
100%
qwen3.7-plus
default
$10.27/M
$10.27/M
L1
100%
qwen3.7-plus
default
$0.015/request
-
L1
100%
qwen3.7-plus
Self-Deployed-2
-85%$0.059/M
Cache read$0.012/M
-85%$0.237/M
L1
100%
qwen3.7-plus
default
$2.00/M
-37%$1.00/M
L1
100%
L2
0%
qwen3.7-plus
default
$75.00/M
$75.00/M
L1
100%
qwen3.7-plus
default
-93%$0.027/M
-93%$0.110/M
L1
99%
qwen3.7-plus
default
-40%$0.240/M
Cache read$0.024/M
-40%$0.960/M
L1
100%
qwen3.7-plus
default
-27%$0.293/M
$1.76/M
L1
100%
qwen3.7-plus
default
-14%$0.342/M
$2.74/M
L1
100%
qwen3.7-plus
🇨🇳国产官方模型
$1.20/M
$4.80/M
L1
100%
qwen3.7-plus
Qwen
-83%$0.068/M
Cache read$0.014/M
-83%$0.274/M
L1
100%
qwen3.7-plus
ALIYUN
-31%$0.275/M
$1.65/M
L1
100%
qwen3.7-plus
qwen-new-cc
$10.27/M
$10.27/M
L1
100%
qwen3.7-plus
国模分组2
$14.60/M
Cache read$2.92/M
$58.40/M
L1
100%
Qwen-Ambassador/Qwen3.7-Plus
default
$0.212/request
-
L1
99%
qwen3.7-plus
default
-45%$0.219/M
Cache read$0.044/M
-45%$0.877/M
当前显示 20 个模型 ID,共 46 个。

替代方案与相似模型

常见问题

Qwen3.7 Plus 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Qwen3.7 Plus 的基准测试、API 价格、输出速度、首字延迟和 96 家服务商数据。
Qwen3.7 Plus API 价格是多少?
Qwen3.7 Plus 在 96 家服务商有价格记录,价格从 $0.015/request$300.00/M。最低价由 VSLLM 提供。
Qwen3.7 Plus API 价格表包含什么?
Qwen3.7 Plus API 价格表会对比 96 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Qwen3.7 Plus API 价格最低?
VSLLM 当前提供 Qwen3.7 Plus 的最低收录价格:$0.015/request,共对比 96 家服务商。
可以同时对比 Qwen3.7 Plus API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Qwen3.7 Plus API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Qwen3.7 Plus 的 API 免费吗?
是的,Qwen3.7 Plus 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Zero API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Qwen3.7 Plus 免费 API?
LMSpeed 当前收录了 1 家 Qwen3.7 Plus 免费 API 服务商,包括Zero API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Qwen-Ambassador/Qwen3.7-PlusQwen3.7-Plus[default]Qwen-Ambassador/Qwen3.7-Plusqwen/qwen3.7-plusqwen3-7-plus

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档