Mistralai
·Released on 2024年11月19日

Mistral Large 2407 API 基准测试 价格和服务商数据

选择与 Mistral Large 2407 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

This is Mistral AI's flagship model, Mistral Large 2 (version mistral-large-2407). It's a proprietary weights-available model and excels at reasoning, code, JSON, chat, and more. Read the launch annou...

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
3 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体-代码40.4综合推理41.1知识-数学44.5多语言-多模态-指令遵循-
#1数学44.5估算2/4 实测维度
80% 区间: 32.756.3
foundational math44.3
math_500 · math_500
competition math44.7
aime · aime
proof frontier仅先验
applied tool math仅先验
#2综合推理41.1估算2/4 实测维度
80% 区间: 30.052.2
abstract logic仅先验
scientific causal39
gpqa · gpqa / hle · hle
multistep constraints43.2
mmlu_pro · mmlu_pro
evidence verification仅先验
#3代码40.4暂定评分1/4 实测维度
80% 区间: 26.554.3
code generation40.4
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识多语言多模态指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
131.1Ktokens
157.3 pages of text
8K128K1M4M
131.1K

能力

Technical Details

输入
输出
发布日期
Nov 2024
知识截止
2024-03-31
官方文档
Tokenizer
Mistral
架构
text+file->text
内容审核
支持参数
frequency_penaltymax_tokenspresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

排名

擅长

详细分数

更新时间: 2026年8月23日

价格

2 个指标

输入价格$2.00/M#139 / 180输出价格$6.00/M#124 / 180
输入价格
Input price
站内排名#139
分数$2.00/M
更新时间2026年8月23日
置信度4
输出价格
Output price
站内排名#124
分数$6.00/M
更新时间2026年8月23日
置信度4

智能体

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验

代码

V3.0

2 个指标 · 暂定评分

分数40.480% 区间26.5–54.31/4 实测维度LiveCodeBench26.7%#97 / 115SciCode27.1%#169 / 204
维度与证据
代码生成40.4
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.62 · q 1.00
scicode · scicode · z -1.10 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#97
分数26.7%
更新时间2026年8月23日
置信度4
SciCodeV3 计分证据
站内排名#169
分数27.1%
更新时间2026年8月23日
置信度4

综合推理

V3.0

3 个指标 · 估算

分数41.180% 区间30.0–52.22/4 实测维度MMLU-Pro68.3%#107 / 129GPQA47.2%#188 / 211
维度与证据
抽象逻辑仅先验
科学与因果推理39
2 个基准族 · 2 个指标
gpqa · gpqa · z -1.24 · q 1.00
hle · hle · z -1.10 · q 1.00
多步约束43.2
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -1.11 · q 1.00
证据整合与验证仅先验
MMLU-ProV3 计分证据
站内排名#107
分数68.3%
更新时间2026年8月23日
置信度4
GPQAV3 计分证据
站内排名#188
分数47.2%
更新时间2026年8月23日
置信度4
HLEV3 计分证据
站内排名#202
分数2.9%
更新时间2026年8月23日
置信度4

知识

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验

数学

V3.0

2 个指标 · 估算

分数44.580% 区间32.7–56.32/4 实测维度AIME9.3%#59 / 68MATH-50071.4%#59 / 73
维度与证据
基础数学44.3
1 个基准族 · 1 个指标
math_500 · math_500 · z -0.73 · q 1.00
竞赛数学44.7
1 个基准族 · 1 个指标
aime · aime · z -0.73 · q 1.00
高阶证明仅先验
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#59
分数9.3%
更新时间2026年8月23日
置信度4
MATH-500V3 计分证据
站内排名#59
分数71.4%
更新时间2026年8月23日
置信度4

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Mistral
mistral
$2/M$6/M100%undefined tokens / —

替代方案与相似模型

别名

mistralai/mistral-large-2407

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。Artificial Analysis标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档