Released on 2026年3月10日

Qwen3.5 API 基准测试 价格和服务商数据

选择与 Qwen3.5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Qwen3.5 页面汇总基准测试、API 价格和服务商数据,覆盖 331 家服务商,价格从 $0.0050/M 起。Qwen3.5 免费 API 额度来自 9 家服务商。页面同时展示实测速度和首字延迟。

Alibaba 的 Qwen3.5是语言模型,专为通用对话与文本生成任务优化。

质量
#61of 100
53.0
LMSpeed 评分
速度
#71of 76
51char/s
10.34 s
成本
#1of 180
$0.0050/ 1M · 8:1 in:out
$0.0008 in · $0.0042 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
8 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体44.7代码40.5综合推理52.3知识53.1数学41.4多语言54.6多模态50.2指令遵循53.7
#1多语言54.6估算2/4 实测维度
80% 区间: 42.466.8
cross language understanding54.9
nova · nova63
multilingual generation仅先验
reasoning transfer54.2
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#2指令遵循53.7估算2/4 实测维度
80% 区间: 41.865.6
constraint following51.5
ifeval · ifeval
structured output仅先验
novel instruction generalization55.8
ifbench · aa_if_bench
long multiturn instruction仅先验
#3知识53.1估算2/4 实测维度
80% 区间: 41.464.7
broad knowledge57.1
c_eval · c_eval / mmlu_redux · mmlu_redux
professional knowledge49.1
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#4综合推理52.3正式评分全站排名 #343/4 实测维度
80% 区间: 44.260.5
abstract logic仅先验
scientific causal41.2
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints59.4
mmlu_pro · mmlu_pro
evidence verification56.4
ai_needle · ai_needle / lcr · lcr / longbench · long_bench_v2
#5多模态50.2正式评分全站排名 #64/4 实测维度
80% 区间: 43.756.6
perception ocr57.3
v_star · v_star
document spatial48.6
charxiv · charxiv
visual reasoning52.5
mathvision · math_vision / mmmu_pro · mmmu_pro
video action42.3
screenspot · screen_spot_pro / video_mmmu · video_mmmu
#6智能体44.7正式评分全站排名 #494/4 实测维度
80% 区间: 39.449.9
planning48.8
deep_planning · gert_labs
tool use42
mcp_atlas · mcp_atlas / mcp_tasks · mcp_tasks / tau · tau2_bench / tau · tau3_bench / toolathlon · toolathlon
environment execution45.3
browsecomp · browse_comp / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2 / vita_bench · vita_bench / wide_research · wide_research
recovery reliability42.6
apex_agents · apex_agents_aa / claw_eval · claw_eval / researchclaw · research_claw_bench
#7数学41.4估算2/4 实测维度
80% 区间: 30.052.9
foundational math仅先验
competition math41.2
aime · aime2026 / hmmt · hmmt_feb2025 / hmmt · hmmt_feb2026 / hmmt · hmmt_nov2025
proof frontier仅先验
applied tool math41.7
mmanswer · mm_answer_bench
#8代码40.5正式评分全站排名 #363/4 实测维度
80% 区间: 31.649.5
code generation30.5
livecodebench · live_code_bench_v6 / scicode · scicode
repository engineering41.5
swe_pro · swe_pro
debugging testing49.5
swe_verified · swe_verified
tooling quality仅先验

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
262.1Ktokens
314.6 pages of text
OUTPUT
262.1Ktokens
8K128K1M4M
262.1K

能力

Technical Details

输入
输出
总参数量
9B
发布日期
Mar 2026
Tokenizer
Qwen3
架构
text+image+video->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月31日

综合

1 个指标

Overall score53.0#61 / 100
Overall score
站内排名#61
分数53.0
更新时间2026年8月31日
置信度4

速度与延迟

2 个指标

输出速度36.8 tok/s#71 / 76首字延迟0.35 s#3 / 76
输出速度
Output speed
站内排名#71
分数36.8 tok/s
更新时间2026年8月31日
置信度4
首字延迟
Time to first token
站内排名#3
分数0.35 s
更新时间2026年8月31日
置信度4

价格

2 个指标

输入价格$0.030/M#1 / 180输出价格$0.150/M#2 / 180
输入价格
Input price
站内排名#1
分数$0.030/M
更新时间2026年8月31日
置信度4
输出价格
Output price
站内排名#2
分数$0.150/M
更新时间2026年8月31日
置信度4

智能体

V3.0

19 个指标 · 正式评分

分数44.7#4980% 区间39.4–49.94/4 实测维度Agentic score32.3#59 / 69Terminal-Bench 2.052.5#42 / 53
维度与证据
规划拆解48.8
1 个基准族 · 1 个指标
deep_planning · gert_labs · z -0.14 · q 1.00
工具调用42
4 个基准族 · 5 个指标
mcp_atlas · mcp_atlas · z -2.04 · q 1.00
mcp_tasks · mcp_tasks · z 0.27 · q 0.63
tau · tau2_bench · z 0.69 · q 1.00
tau · tau3_bench · z -0.70 · q 1.00
toolathlon · toolathlon · z -1.22 · q 1.00
环境与长程执行45.3
5 个基准族 · 5 个指标
browsecomp · browse_comp · z -1.27 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.60 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.69 · q 1.00
vita_bench · vita_bench · z 0.37 · q 1.00
wide_research · wide_research · z 0.00 · q 1.00
恢复与完成可靠性42.6
3 个基准族 · 3 个指标
apex_agents · apex_agents_aa · z -0.76 · q 1.00
claw_eval · claw_eval · z -0.45 · q 1.00
researchclaw · research_claw_bench · z -1.29 · q 1.00
Agentic score
站内排名#59
分数32.3
更新时间2026年8月31日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#42
分数52.5
更新时间2026年8月31日
置信度4
BrowseCompV3 计分证据
站内排名#26
分数62.0
更新时间2026年8月31日
置信度4
Claw-EvalV3 计分证据
站内排名#20
分数56.8
更新时间2026年8月31日
置信度4
QwenClawBench
站内排名#10
分数51.8
更新时间2026年8月31日
置信度4
Τ³-bench resultsV3 计分证据
站内排名#6
分数68.4
更新时间2026年8月31日
置信度4
VITA-BenchV3 计分证据
站内排名#4
分数43.7
更新时间2026年8月31日
置信度4
DeepPlanningV3 计分证据
站内排名#3
分数37.6
更新时间2026年8月31日
置信度4
ToolathlonV3 计分证据
站内排名#21
分数36.3
更新时间2026年8月31日
置信度4
MCP AtlasV3 计分证据
站内排名#28
分数46.1
更新时间2026年8月31日
置信度4
MCP-TasksV3 计分证据
站内排名#1
分数74.2
更新时间2026年8月31日
置信度4
WideResearchV3 计分证据
站内排名#5
分数74.0
更新时间2026年8月31日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#17
分数95.6
更新时间2026年8月31日
置信度4
Gert LabsV3 计分证据
站内排名#27
分数46.8
更新时间2026年8月31日
置信度4
ResearchClawBenchV3 计分证据
站内排名#15
分数14.2
更新时间2026年8月31日
置信度4
AA Agentic Index
站内排名#51
分数19.9
更新时间2026年8月31日
置信度4
APEX-Agents-AAV3 计分证据
站内排名#16
分数15.3
更新时间2026年8月31日
置信度4
GDPval-AA
站内排名#48
分数23.3
更新时间2026年8月31日
置信度4
GDPval-AAV3 计分证据
站内排名#48
分数966.0
更新时间2026年8月31日
置信度4

代码

V3.0

7 个指标 · 正式评分

分数40.5#3680% 区间31.6–49.53/4 实测维度SciCode16.1%#202 / 205Coding score42.1#68 / 81
维度与证据
代码生成30.5
2 个基准族 · 2 个指标
livecodebench · live_code_bench_v6 · z -0.71 · q 0.75
scicode · scicode · z -3.00 · q 1.00
仓库工程41.5
1 个基准族 · 1 个指标
swe_pro · swe_pro · z -1.07 · q 1.00
调试与测试49.5
1 个基准族 · 1 个指标
swe_verified · swe_verified · z -0.12 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#202
分数16.1%
更新时间2026年8月31日
置信度4
Coding score
站内排名#68
分数42.1
更新时间2026年8月31日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#29
分数76.2
更新时间2026年8月31日
置信度4
LiveCodeBench v6V3 计分证据
站内排名#6
分数83.6
更新时间2026年8月31日
置信度4
SWE-bench ProV3 计分证据
站内排名#45
分数50.9
更新时间2026年8月31日
置信度4
AA-SciCodeV3 计分证据
站内排名#59
分数42.0
更新时间2026年8月31日
置信度4
AA Coding Index
站内排名#45
分数48.2
更新时间2026年8月31日
置信度4

综合推理

V3.0

8 个指标 · 正式评分

分数52.3#3480% 区间44.2–60.53/4 实测维度MMLU-Pro87.8%#8 / 129GPQA77.1%#108 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理41.2
3 个基准族 · 3 个指标
critpt · critpt · z -0.21 · q 1.00
gpqa · gpqa · z -1.32 · q 1.00
hle · hle · z -1.17 · q 1.00
多步约束59.4
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 1.05 · q 1.00
证据整合与验证56.4
3 个基准族 · 3 个指标
ai_needle · ai_needle · z 0.09 · q 0.50
lcr · lcr · z 0.18 · q 1.00
longbench · long_bench_v2 · z 1.14 · q 1.00
MMLU-ProV3 计分证据
站内排名#8
分数87.8%
更新时间2026年8月31日
置信度4
GPQAV3 计分证据
站内排名#108
分数77.1%
更新时间2026年8月31日
置信度4
HLEV3 计分证据
站内排名#117
分数9.9%
更新时间2026年8月31日
置信度4
Reasoning score
站内排名#17
分数65.7
更新时间2026年8月31日
置信度4
LongBench v2V3 计分证据
站内排名#3
分数63.2
更新时间2026年8月31日
置信度4
AI-NeedleV3 计分证据
站内排名#2
分数68.7
更新时间2026年8月31日
置信度4
AA-LCRV3 计分证据
站内排名#43
分数72.7
更新时间2026年8月31日
置信度4
CritPtV3 计分证据
站内排名#58
分数1.7
更新时间2026年8月31日
置信度4

知识

V3.0

9 个指标 · 估算

分数53.180% 区间41.4–64.72/4 实测维度Knowledge score53.6#57 / 69SuperGPQA70.4#8 / 16
维度与证据
广泛知识57.1
2 个基准族 · 2 个指标
c_eval · c_eval · z 0.71 · q 0.63
mmlu_redux · mmlu_redux · z 0.56 · q 0.75
专业知识49.1
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z 0.13 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#57
分数53.6
更新时间2026年8月31日
置信度4
SuperGPQAV3 计分证据
站内排名#8
分数70.4
更新时间2026年8月31日
置信度4
MMLU-ReduxV3 计分证据
站内排名#3
分数94.9
更新时间2026年8月31日
置信度4
C-EvalV3 计分证据
站内排名#2
分数93.0
更新时间2026年8月31日
置信度4
Artificial Analysis Intelligence Index
站内排名#65
分数34.3
更新时间2026年8月31日
置信度4
AA-GPQA Diamond
站内排名#37
分数89.3
更新时间2026年8月31日
置信度4
AA-HLE
站内排名#46
分数29.0
更新时间2026年8月31日
置信度4
AA-Omniscience Accuracy
站内排名#50
分数30.8
更新时间2026年8月31日
置信度4
AA-Omniscience Hallucination Rate
站内排名#23
分数88.9
更新时间2026年8月31日
置信度4

数学

V3.0

6 个指标 · 估算

分数41.480% 区间30.0–52.92/4 实测维度Math score74.3#14 / 62AIME2693.3#12 / 14
维度与证据
基础数学仅先验
竞赛数学41.2
2 个基准族 · 4 个指标
aime · aime2026 · z -1.54 · q 1.00
hmmt · hmmt_feb2025 · z 0.00 · q 0.88
hmmt · hmmt_feb2026 · z 0.07 · q 1.00
hmmt · hmmt_nov2025 · z -0.25 · q 1.00
高阶证明仅先验
应用与工具辅助数学41.7
1 个基准族 · 1 个指标
mmanswer · mm_answer_bench · z -1.06 · q 1.00
Math score
站内排名#14
分数74.3
更新时间2026年8月31日
置信度4
AIME26V3 计分证据
站内排名#12
分数93.3
更新时间2026年8月31日
置信度4
HMMT Feb 2025V3 计分证据
站内排名#4
分数94.8
更新时间2026年8月31日
置信度4
HMMT Nov 2025V3 计分证据
站内排名#6
分数92.7
更新时间2026年8月31日
置信度4
HMMT Feb 2026V3 计分证据
站内排名#10
分数87.9
更新时间2026年8月31日
置信度4
MMAnswerBenchV3 计分证据
站内排名#8
分数80.9
更新时间2026年8月31日
置信度4

多语言

V3.0

3 个指标 · 估算

分数54.680% 区间42.4–66.82/4 实测维度Multilingual score69.7#4 / 11MMLU-ProX84.7#4 / 11
维度与证据
跨语言理解54.9
1 个基准族 · 1 个指标
nova · nova63 · z 0.64 · q 0.88
多语言生成仅先验
推理迁移54.2
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z 0.77 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#4
分数69.7
更新时间2026年8月31日
置信度4
MMLU-ProXV3 计分证据
站内排名#4
分数84.7
更新时间2026年8月31日
置信度4
NOVA-63V3 计分证据
站内排名#1
分数59.1
更新时间2026年8月31日
置信度4

多模态

V3.0

8 个指标 · 正式评分

分数50.2#680% 区间43.7–56.64/4 实测维度Multimodal Grounded score59.5#28 / 44MMMU-Pro79.0#13 / 31
维度与证据
感知与 OCR57.3
1 个基准族 · 1 个指标
v_star · v_star · z 0.72 · q 1.00
文档与空间理解48.6
1 个基准族 · 1 个指标
charxiv · charxiv · z -0.07 · q 1.00
视觉推理52.5
2 个基准族 · 2 个指标
mathvision · math_vision · z 0.40 · q 1.00
mmmu_pro · mmmu_pro · z 0.12 · q 1.00
视频与落地行动42.3
2 个基准族 · 2 个指标
screenspot · screen_spot_pro · z -1.12 · q 1.00
video_mmmu · video_mmmu · z 0.03 · q 1.00
Multimodal Grounded score
站内排名#28
分数59.5
更新时间2026年8月31日
置信度4
MMMU-ProV3 计分证据
站内排名#13
分数79.0
更新时间2026年8月31日
置信度4
MathVisionV3 计分证据
站内排名#5
分数88.6
更新时间2026年8月31日
置信度4
CharXivV3 计分证据
站内排名#18
分数80.8
更新时间2026年8月31日
置信度4
VideoMMMUV3 计分证据
站内排名#5
分数84.7
更新时间2026年8月31日
置信度4
ScreenSpot ProV3 计分证据
站内排名#10
分数65.6
更新时间2026年8月31日
置信度4
V*V3 计分证据
站内排名#3
分数95.8
更新时间2026年8月31日
置信度4
AA-MMMU-Pro
站内排名#24
分数77.3
更新时间2026年8月31日
置信度4

指令遵循

V3.0

3 个指标 · 估算

分数53.780% 区间41.8–65.62/4 实测维度Instruction Following score87.4#12 / 25IFEval92.6#8 / 16
维度与证据
约束遵循51.5
1 个基准族 · 1 个指标
ifeval · ifeval · z 0.00 · q 1.00
结构化输出仅先验
新指令泛化55.8
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.50 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#12
分数87.4
更新时间2026年8月31日
置信度4
IFEvalV3 计分证据
站内排名#8
分数92.6
更新时间2026年8月31日
置信度4
AA-IFBenchV3 计分证据
站内排名#5
分数78.8
更新时间2026年8月31日
置信度4

价格对比

对比 Qwen3.5 在 322 家服务商的 API 价格。价格从 $0.0050/M 到 $1718.28/M,其中 RenRen API 提供最低价 $0.0050/M。 9 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
qwen3.5-35b-a3b
default
-9%$0.027/M
$0.219/M
L1
100%
qwen3.5-27b
default
$0.041/M
$0.329/M
L1
100%
qwen3.5-122b-a10b
default
$0.055/M
$0.438/M
L1
100%
qwen3.5-397b-a17b
default
$0.082/M
$0.493/M
L1
100%
Qwen3.5-35B-A3B
default
$0.020/request
-
L1
100%
Qwen3.5-122B-A10B
default
$0.020/request
-
L1
100%
qwen3.5-35b-a3b
qwen
$0.160/M
$1.28/M
L1
100%
qwen3.5-27b
qwen
$0.240/M
$1.92/M
L1
100%
qwen3.5-122b-a10b
qwen
$0.320/M
$2.56/M
L1
100%
qwen3.5-397b-a17b
qwen
$0.480/M
$2.88/M
L1
100%
qwen3.5-35b-a3b
default
$0.055/M
$0.438/M
L1
100%
qwen3.5-27b
default
$0.082/M
$0.658/M
L1
100%
qwen3.5-122b-a10b
default
$0.110/M
$0.877/M
L1
100%
qwen3.5-397b-a17b
default
$0.164/M
$0.986/M
L1
100%
qwen3.5-397b-a17b
default
$10.27/M
$10.27/M
L1
100%
L2
62%
qwen3.5-122b-a10b
nvidia
$0.400/M
$3.20/M
L1
100%
L2
62%
qwen3.5-397b-a17b
nvidia
$0.430/M
$2.58/M
L1
100%
qwen3.5-122b-a10b
deepseek
$4.11/M
$4.11/M
L1
100%
qwen3.5-35b-a3b
deepseek
$4.11/M
$4.11/M
L1
100%
qwen3.5-27b
deepseek
$4.11/M
$4.11/M
当前显示 20 个模型 ID,共 131 个。

替代方案与相似模型

常见问题

Qwen3.5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Qwen3.5 的基准测试、API 价格、输出速度、首字延迟和 331 家服务商数据。
Qwen3.5 API 价格是多少?
Qwen3.5331 家服务商有价格记录,价格从 $0.0050/M $1718.28/M。最低价由 RenRen API 提供。
Qwen3.5 API 价格表包含什么?
Qwen3.5 API 价格表会对比 331 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Qwen3.5 API 价格最低?
RenRen API 当前提供 Qwen3.5 的最低收录价格:$0.0050/M,共对比 331 家服务商。
可以同时对比 Qwen3.5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Qwen3.5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Qwen3.5 的 API 免费吗?
是的,Qwen3.5 免费 API 可通过 LMSpeed 上的 9 家服务商使用,包括Dext API, ApiToken Online, Dext API, Zero API, Zero API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Qwen3.5 免费 API?
LMSpeed 当前收录了 9 家 Qwen3.5 免费 API 服务商,包括Dext API, ApiToken Online, Dext API, Zero API, Zero API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Qwen/Qwen3.5-122B-A10BQwen/Qwen3.5-27BQwen/Qwen3.5-35B-A3BQwen/Qwen3.5-397B-A17BQwen/Qwen3.5-4B

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档