Qwen
·Released on 2026年3月10日Qwen3.5-9B API 基准测试 价格和服务商数据
选择与 Qwen3.5-9B 对比的模型
选择一个模型后会直接打开对应的对比页面。
LLM
Qwen3.5-9B is a multimodal foundation model from the Qwen3.5 family, designed to deliver strong reasoning, coding, and visual understanding in an efficient 9B-parameter architecture. It uses a unified...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 2 / 8
- 方法论
- V3.0
#1综合推理52暂定评分1/4 实测维度
80% 区间: 38.1–65.9
abstract logic仅先验
scientific causal52
gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification仅先验
#2代码43.2暂定评分1/4 实测维度
80% 区间: 27.2–59.2
code generation43.2
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识数学多语言多模态指令遵循
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
INPUT
262.1Ktokens
≈ 314.6 pages of text
OUTPUT
262.1Ktokens
8K128K1M4M
262.1K
能力
排名
擅长
详细分数
更新时间: 2026年8月23日速度与延迟
2 个指标
输出速度89.8 tok/s#40 / 74首字延迟0.47 s#7 / 74
速度与延迟
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
价格
2 个指标
输入价格$0.170/M#28 / 180输出价格$0.250/M#8 / 180
价格
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验
代码
V3.01 个指标 · 暂定评分
分数43.280% 区间27.2–59.21/4 实测维度SciCode27.7%#166 / 204
代码
V3.01 个指标 · 暂定评分
维度与证据
代码生成43.2
1 个基准族 · 1 个指标
scicode · scicode · z -1.05 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
基准
站内排名
分数
来源
更新时间
置信度
综合推理
V3.02 个指标 · 暂定评分
分数5280% 区间38.1–65.91/4 实测维度GPQA78.6%#98 / 211HLE9.4%#120 / 208
综合推理
V3.02 个指标 · 暂定评分
维度与证据
抽象逻辑仅先验
科学与因果推理52
2 个基准族 · 2 个指标
gpqa · gpqa · z 0.20 · q 1.00
hle · hle · z 0.06 · q 1.00
多步约束仅先验
证据整合与验证仅先验
基准
站内排名
分数
来源
更新时间
置信度
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验
OpenRouter 端点
5 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
Parasail parasail/bf16 | $0.100/M | $0.250/M | 100.0% | — | — | undefined tokens / undefined tokens |
Venice venice/fp8 | $0.100/M | $0.150/M | 99.9% | — | — | undefined tokens / undefined tokens |
Together together | $0.170/M | $0.250/M | 99.7% | — | — | undefined tokens / — |
SiliconFlow siliconflow/fp8 | $0.100/M | $0.150/M | 99.3% | — | — | undefined tokens / undefined tokens |
DeepInfra deepinfra/bf16 | $0.100/M | $0.150/M | 95.2% | — | — | undefined tokens / undefined tokens |
