Mistral Large 3 API Benchmarks, Pricing & Provider Data
Compare Mistral Large 3 with another model
Choose a model to open its comparison page.
На странице также приведены измеренная скорость API и задержка первого токена.
Mistral Large 3 is Mistral AI's advanced multilingual frontier model, offering strong reasoning, coding, and instruction-following for production chat and agent workloads.
Производительность по категориям
Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.
- Покрытие
- 6 / 8
- Методология
- V3.0
#1Программирование45.7Предварительная1/4 Измеренные измерения
#2Рассуждение44.3РейтинговаяОбщий рейтинг #573/4 Измеренные измерения
#3Математика43.5Предварительная1/4 Измеренные измерения
#4Следование инструкциям42.3Предварительная1/4 Измеренные измерения
#5Знания41.5Предварительная1/4 Измеренные измерения
#6Агенты39.8Оценка2/4 Измеренные измерения
Specifications
Rankings
Excels at
Falls behind in
Подробные оценки
Обновлено: 14 сент. 2026 г.Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Скорость вывода77.0 tok/s#55 / 80Время до первого токена0.67 s#15 / 80
Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цена входных данных$0.500/M#85 / 186Цена выходных данных$1.50/M#65 / 186
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка39.880% интервал28.0–51.62/4 Измеренные измеренияAA Agentic Index5.5#61 / 70Τ²-bench results24.6#74 / 82
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка45.780% интервал31.7–59.61/4 Измеренные измеренияLiveCodeBench46.5%#64 / 115SciCode36.6%#71 / 89
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Оценка44.3#5780% интервал35.7–53.03/4 Измеренные измеренияMMLU-Pro80.7%#58 / 129GPQA68.0%#146 / 218
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка41.580% интервал25.5–57.51/4 Измеренные измеренияArtificial Analysis Intelligence Index15.9#96 / 117AA-GPQA Diamond68.0#94 / 113
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка43.580% интервал27.4–59.61/4 Измеренные измерения
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
80% интервал30.8–69.20/4 Измеренные измеренияAA-MMMU-Pro55.7#60 / 68
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка42.380% интервал26.3–58.31/4 Измеренные измеренияAA-IFBench36.2#77 / 84
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Альтернативы и похожие модели
GLM-5.1
glm-5-1
Zhipu GLM-5.1 is a next-generation GLM model aimed at frontier reasoning, coding, and bilingual agent applications.
Kimi K2.5
kimi-k2-5
Moonshot Kimi K2.5 is an open-weight multimodal agent model with native vision and text input, strong coding performance, and a 256K context window.
Gemini 3 Flash
gemini-3-flash
Google Gemini 3 Flash is a next-generation fast multimodal model for responsive assistants, document understanding, and high-throughput API traffic.
GLM-5
glm-5
Zhipu GLM-5 is Zhipu flagship GLM series model with enhanced reasoning, agent capabilities, and strong performance on Chinese enterprise and coding scenarios.
MiniMax M2.7
minimax-m2-7
MiniMax M2.7 is a high-tier M2-series model tuned for complex reasoning, long-context dialogue, and production-grade API workloads.
GPT-OSS
gpt-oss
GPT-OSS is an open-weight language model family designed for self-hosted inference, research, and cost-efficient alternatives to proprietary GPT-class models.
