Mistral Large 3 API Benchmarks, Pricing & Provider Data

Compare Mistral Large 3 with another model

Choose a model to open its comparison page.

Share on X
LLM

На странице также приведены измеренная скорость API и задержка первого токена.

Mistral Large 3 is Mistral AI's advanced multilingual frontier model, offering strong reasoning, coding, and instruction-following for production chat and agent workloads.

Качество
0.0
Оценка LMSpeed
Скорость
#55of 80
29char/s
3.00 s

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
6 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты39.8Программирование45.7Рассуждение44.3Знания41.5Математика43.5Многоязычность-Мультимодальность-Следование инструкциям42.3
#1Программирование45.7Предварительная1/4 Измеренные измерения
80% интервал: 31.759.6
code generation45.7
livecodebench · livecodebench / scicode · scicode
repository engineeringТолько априорное
debugging testingТолько априорное
tooling qualityТолько априорное
#2Рассуждение44.3РейтинговаяОбщий рейтинг #573/4 Измеренные измерения
80% интервал: 35.753.0
abstract logicТолько априорное
scientific causal43.7
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints52.1
mmlu_pro · mmlu_pro
evidence verification37.3
lcr · lcr
#3Математика43.5Предварительная1/4 Измеренные измерения
80% интервал: 27.459.6
foundational math43.5
aa_math_index · artificial_analysis_math_index
competition mathТолько априорное
proof frontierТолько априорное
applied tool mathТолько априорное
#4Следование инструкциям42.3Предварительная1/4 Измеренные измерения
80% интервал: 26.358.3
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization42.3
ifbench · aa_if_bench
long multiturn instructionТолько априорное
#5Знания41.5Предварительная1/4 Измеренные измерения
80% интервал: 25.557.5
broad knowledge41.5
aa_omniscience · aa_omniscience_index
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#6Агенты39.8Оценка2/4 Измеренные измерения
80% интервал: 28.051.6
planningТолько априорное
tool use38.5
tau · tau2_bench
environment execution41.1
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliabilityТолько априорное
Нет данных:МногоязычностьМультимодальность

Specifications

Technical Details

Документация

Rankings

Excels at

Falls behind in

Подробные оценки

Обновлено: 14 сент. 2026 г.

Скорость и задержка

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Скорость вывода77.0 tok/s#55 / 80Время до первого токена0.67 s#15 / 80
Скорость вывода
Output speed
Рейтинг LMSpeed#55
Оценка77.0 tok/s
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
Время до первого токена
Time to first token
Рейтинг LMSpeed#15
Оценка0.67 s
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.500/M#85 / 186Цена выходных данных$1.50/M#65 / 186
Цена входных данных
Input price
Рейтинг LMSpeed#85
Оценка$0.500/M
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#65
Оценка$1.50/M
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка39.880% интервал28.0–51.62/4 Измеренные измеренияAA Agentic Index5.5#61 / 70Τ²-bench results24.6#74 / 82
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментов38.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
tau · tau2_bench · z -1.64 · q 1.00
Среда и длительное выполнение41.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
gdpval_aa · benchlm_agentic_gdpval_aa · z -1.32 · q 1.00
Восстановление и надёжность завершенияТолько априорное
AA Agentic Index
Рейтинг LMSpeed#61
Оценка5.5
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
Τ²-bench resultsДоказательство V3
Рейтинг LMSpeed#74
Оценка24.6
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
GDPval-AA
Рейтинг LMSpeed#62
Оценка7.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
GDPval-AAДоказательство V3
Рейтинг LMSpeed#63
Оценка639.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка45.780% интервал31.7–59.61/4 Измеренные измеренияLiveCodeBench46.5%#64 / 115SciCode36.6%#71 / 89
Измерения и доказательства
Генерация кода45.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
livecodebench · livecodebench · z -0.05 · q 1.00
scicode · scicode · z -0.68 · q 1.00
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#64
Оценка46.5%
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
SciCodeДоказательство V3
Рейтинг LMSpeed#71
Оценка36.6%
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
AA Coding Index
Рейтинг LMSpeed#70
Оценка20.1
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#89
Оценка36.2
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка44.3#5780% интервал35.7–53.03/4 Измеренные измеренияMMLU-Pro80.7%#58 / 129GPQA68.0%#146 / 218
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение43.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z -0.71 · q 1.00
gpqa · gpqa · z -0.48 · q 1.00
hle · hle · z -0.88 · q 1.00
Многошаговые ограничения52.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z 0.08 · q 1.00
Интеграция и проверка свидетельств37.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z -2.05 · q 1.00
MMLU-ProДоказательство V3
Рейтинг LMSpeed#58
Оценка80.7%
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
GPQAДоказательство V3
Рейтинг LMSpeed#146
Оценка68.0%
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#177
Оценка4.2%
Источникartificialanalysis.ai
Обновлено14 сент. 2026 г.
Достоверность4
AA-LCRДоказательство V3
Рейтинг LMSpeed#96
Оценка34.7
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка41.580% интервал25.5–57.51/4 Измеренные измеренияArtificial Analysis Intelligence Index15.9#96 / 117AA-GPQA Diamond68.0#94 / 113
Измерения и доказательства
Широкие знания41.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · aa_omniscience_index · z -1.22 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#96
Оценка15.9
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-GPQA Diamond
Рейтинг LMSpeed#94
Оценка68.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-HLE
Рейтинг LMSpeed#102
Оценка4.2
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-Omniscience Accuracy
Рейтинг LMSpeed#71
Оценка25.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#27
Оценка86.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка43.580% интервал27.4–59.61/4 Измеренные измерения
Измерения и доказательства
Базовая математика43.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_math_index · artificial_analysis_math_index · z -0.47 · q 1.00
Олимпиадная математикаТолько априорное
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

80% интервал30.8–69.20/4 Измеренные измеренияAA-MMMU-Pro55.7#60 / 68
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное
AA-MMMU-Pro
Рейтинг LMSpeed#60
Оценка55.7
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка42.380% интервал26.3–58.31/4 Измеренные измеренияAA-IFBench36.2#77 / 84
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций42.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z -1.32 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#77
Оценка36.2
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Альтернативы и похожие модели

Также известна как

mistral-large-3mistral-large-3:675bmistral-large-3:675b-cloudmistral-large-3:freemistral-large-3:full-context

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API