Devstral 2 API 基准测试 价格和服务商数据
选择与 Devstral 2 对比的模型
选择一个模型后会直接打开对应的对比页面。
LLM
Devstral 2 已收录 1 家 API 服务商。Devstral 2 免费 API 额度来自 1 家服务商。页面同时展示实测速度和首字延迟。
Mistral 的 Devstral 2是代码专精模型,专为代码生成、调试与软件开发任务优化。
速度
#53of 78
71char/s
1.34 s
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 3 / 8
- 方法论
- V3.0
#1代码46.1暂定评分1/4 实测维度
80% 区间: 32.2–60.1
code generation46.1
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
#2综合推理45.2估算2/4 实测维度
80% 区间: 34.1–56.4
abstract logic仅先验
scientific causal41.9
gpqa · gpqa / hle · hle
multistep constraints48.5
mmlu_pro · mmlu_pro
evidence verification仅先验
#3数学43.2暂定评分1/4 实测维度
80% 区间: 27.1–59.4
foundational math43.2
aa_math_index · artificial_analysis_math_index
competition math仅先验
proof frontier仅先验
applied tool math仅先验
暂无数据:智能体知识多语言多模态指令遵循
技术规格
排名
擅长
详细分数
更新时间: 2026年9月2日速度与延迟
2 个指标
输出速度65.7 tok/s#53 / 78首字延迟0.65 s#16 / 78
速度与延迟
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验
代码
V3.02 个指标 · 暂定评分
分数46.180% 区间32.2–60.11/4 实测维度LiveCodeBench44.8%#67 / 115SciCode33.1%#140 / 207
代码
V3.02 个指标 · 暂定评分
维度与证据
代码生成46.1
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.09 · q 1.00
scicode · scicode · z -0.46 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
基准
站内排名
分数
来源
更新时间
置信度
综合推理
V3.03 个指标 · 估算
分数45.280% 区间34.1–56.42/4 实测维度MMLU-Pro76.2%#80 / 129GPQA59.4%#166 / 214
综合推理
V3.03 个指标 · 估算
维度与证据
抽象逻辑仅先验
科学与因果推理41.9
2 个基准族 · 2 个指标
gpqa · gpqa · z -0.80 · q 1.00
hle · hle · z -0.95 · q 1.00
多步约束48.5
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -0.40 · q 1.00
证据整合与验证仅先验
基准
站内排名
分数
来源
更新时间
置信度
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
数学
V3.00 个指标 · 暂定评分
分数43.280% 区间27.1–59.41/4 实测维度
数学
V3.00 个指标 · 暂定评分
维度与证据
基础数学43.2
1 个基准族 · 1 个指标
aa_math_index · artificial_analysis_math_index · z -0.50 · q 1.00
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验
价格对比
Devstral 2 可通过 1 家服务商免费使用,无需按 token 付费。
| 服务商 | 健康度 | 模型变体 | 分组 | 输入 ($/M) | 输出 ($/M) | 速度 (t/s) | 首字延迟 | 检测 |
|---|---|---|---|---|---|---|---|---|
L1 99% | devstral-2:123b | default | 免费 | 免费 | — | — | — |
替代方案与相似模型
Kimi K2.5
kimi-k2-5
Moonshot 的 Kimi K2.5是语言模型,专为通用对话与文本生成任务优化。
9 个共享提供商
GLM-5
glm-5
Zhipu 的 GLM-5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
9 个共享提供商
MiniMax M2.5
minimax-m2-5
MiniMax M2.5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
9 个共享提供商
GLM-4.7
glm-4-7
Zhipu 的 GLM-4.7是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
9 个共享提供商
GLM-5.1
glm-5-1
Zhipu 的 GLM-5.1是语言模型,专为通用对话与文本生成任务优化。
8 个共享提供商
Gemini 3 Flash
gemini-3-flash
Google 的 Gemini 3 Flash是Gemini 3 系列的语言模型,专为通用对话与文本生成任务优化。
8 个共享提供商
常见问题
- 可以同时对比 Devstral 2 API 价格和速度吗?
- 可以。LMSpeed 会在同一页展示 Devstral 2 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
- Devstral 2 的 API 免费吗?
- 是的,Devstral 2 免费 API 可通过 LMSpeed 上的 1 家服务商使用,包括Moyanjdc API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
- 哪里可以使用 Devstral 2 免费 API?
- LMSpeed 当前收录了 1 家 Devstral 2 免费 API 服务商,包括Moyanjdc API。免费额度和限制可能变化,使用前请查看每一行服务商数据。
