Mistral Large 2407 API 基准测试 价格和服务商数据
选择与 Mistral Large 2407 对比的模型
选择一个模型后会直接打开对应的对比页面。
This is Mistral AI's flagship model, Mistral Large 2 (version mistral-large-2407). It's a proprietary weights-available model and excels at reasoning, code, JSON, chat, and more. Read the launch annou...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 3 / 8
- 方法论
- V3.0
#1数学44.5估算2/4 实测维度
#2综合推理41.1估算2/4 实测维度
#3代码40.4暂定评分1/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
详细分数
更新时间: 2026年8月23日价格
2 个指标
输入价格$2.00/M#139 / 180输出价格$6.00/M#124 / 180
价格
2 个指标
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
代码
V3.02 个指标 · 暂定评分
分数40.480% 区间26.5–54.31/4 实测维度LiveCodeBench26.7%#97 / 115SciCode27.1%#169 / 204
代码
V3.02 个指标 · 暂定评分
综合推理
V3.03 个指标 · 估算
分数41.180% 区间30.0–52.22/4 实测维度MMLU-Pro68.3%#107 / 129GPQA47.2%#188 / 211
综合推理
V3.03 个指标 · 估算
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
数学
V3.02 个指标 · 估算
分数44.580% 区间32.7–56.32/4 实测维度AIME9.3%#59 / 68MATH-50071.4%#59 / 73
数学
V3.02 个指标 · 估算
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
OpenRouter 端点
1 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
Mistral mistral | $2/M | $6/M | 100% | — | — | undefined tokens / — |
替代方案与相似模型
GPT-5.4
gpt-5-4
OpenAI 的 GPT-5.4是语言模型,专为通用对话与文本生成任务优化。
GPT-5.3 Codex
gpt-5-3-codex
OpenAI 的 GPT-5.3 Codex是GPT-5.3 系列的代码专精模型,专为代码生成、调试与软件开发任务优化。
GPT-5.2
gpt-5-2
OpenAI 的 GPT-5.2是语言模型,专为通用对话与文本生成任务优化。
GPT-5.4 Mini
gpt-5-4-mini
OpenAI 的 GPT-5.4 Mini是GPT-5.4 系列的轻量语言模型,专为低延迟、低成本的通用对话任务优化。
Claude Opus 4.6
claude-opus-4-6
Anthropic 的 Claude Opus 4.6是语言模型,专为通用对话与文本生成任务优化。
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。
