Meta
·Released on 16 июл. 2026 г.

Muse Spark 1.1 API Benchmarks, Pricing & Provider Data

Compare Muse Spark 1.1 with another model

Choose a model to open its comparison page.

Share on X
LLM

Muse Spark 1.1 is a multimodal reasoning model from Meta, built for agentic tasks. It accepts text, images, video, audio, and PDF documents and returns text, with a 1M-token context...

Качество
#14of 112
72.0
Оценка LMSpeed

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
5 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты61.6Программирование58Рассуждение57.5Знания63.3Математика-Многоязычность-Мультимодальность56.5Следование инструкциям-
#1Знания63.3Предварительная1/4 Измеренные измерения
80% интервал: 49.377.3
broad knowledge63.3
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#2Агенты61.6РейтинговаяОбщий рейтинг #103/4 Измеренные измерения
80% интервал: 54.268.9
planningТолько априорное
tool use77.1
mcp_atlas · mcp_atlas / toolathlon · toolathlon
environment execution59.7
deep_search_qa · deep_search_qa / enterprise_ops_gym · aa_enterprise_ops_gym / gdpval_aa · benchlm_agentic_gdpval_aa / osworld · os_world2 / osworld · os_world_verified / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability48
cyber_gym · cyber_gym / exploit_gym · exploit_gym / harvey_lab · aa_harvey_lab / jobbench · job_bench
#3Программирование58Оценка3/4 Измеренные измерения
80% интервал: 48.867.3
code generation62.8
scicode · scicode
repository engineering55.1
swe_pro · swe_pro
debugging testingТолько априорное
tooling quality56.2
terminalbench · benchlm_coding_terminal_bench2
#4Рассуждение57.5Оценка2/4 Измеренные измерения
80% интервал: 47.467.7
abstract logicТолько априорное
scientific causal61.5
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraintsТолько априорное
evidence verification53.5
lcr · lcr / mrcr · mrcr1m
#5Мультимодальность56.5Предварительная1/4 Измеренные измерения
80% интервал: 40.472.6
perception ocrТолько априорное
document spatial56.5
charxiv · charxiv
visual reasoningТолько априорное
video actionТолько априорное
Нет данных:МатематикаМногоязычностьСледование инструкциям

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
943.7Ktokens
8K128K1M4M
1.0M

Возможности

Technical Details

Вход
Выход
Выпущена
Jul 2026
Документация
Токенизатор
Other
Архитектура
text+image+file+audio+video->text
Модерация
Да
Поддерживаемые параметры
include_reasoningmax_tokensreasoningreasoning_effortrepetition_penaltyresponse_formatstructured_outputstemperaturetool_choicetoolstop_ktop_p

Rankings

Excels at

It's decent at

Falls behind in

Подробные оценки

Обновлено: 13 сент. 2026 г.

Общее

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Overall score72.0#14 / 112DeepSWE53.3#17 / 21
Overall score
Рейтинг LMSpeed#14
Оценка72.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
DeepSWE
Рейтинг LMSpeed#17
Оценка53.3
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность3

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$1.25/M#123 / 186Цена выходных данных$4.25/M#116 / 186
Цена входных данных
Input price
Рейтинг LMSpeed#123
Оценка$1.25/M
Источникartificialanalysis.ai
Обновлено13 сент. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#116
Оценка$4.25/M
Источникartificialanalysis.ai
Обновлено13 сент. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка61.6#1080% интервал54.2–68.93/4 Измеренные измеренияAgentic score76.1#24 / 77Terminal-Bench 2.080.0#10 / 53
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментов77.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mcp_atlas · mcp_atlas · z 1.81 · q 1.00
toolathlon · toolathlon · z 3.00 · q 1.00
Среда и длительное выполнение59.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
deep_search_qa · deep_search_qa · z 0.11 · q 1.00
enterprise_ops_gym · aa_enterprise_ops_gym · z 0.44 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.53 · q 1.00
osworld · os_world2 · z -0.30 · q 1.00
osworld · os_world_verified · z 0.80 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 1.21 · q 1.00
Восстановление и надёжность завершения48
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
cyber_gym · cyber_gym · z -1.60 · q 1.00
exploit_gym · exploit_gym · z -2.81 · q 0.58
harvey_lab · aa_harvey_lab · z 0.58 · q 1.00
jobbench · job_bench · z 1.00 · q 1.00
Agentic score
Рейтинг LMSpeed#24
Оценка76.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Terminal-Bench 2.0Доказательство V3
Рейтинг LMSpeed#10
Оценка80.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
MCP AtlasДоказательство V3
Рейтинг LMSpeed#1
Оценка88.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
ToolathlonДоказательство V3
Рейтинг LMSpeed#1
Оценка75.6
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
OSWorld-VerifiedДоказательство V3
Рейтинг LMSpeed#7
Оценка80.8
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
DeepSearchQAДоказательство V3
Рейтинг LMSpeed#7
Оценка84.9
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
CyberGymДоказательство V3
Рейтинг LMSpeed#13
Оценка59.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Finance Agent v2
Рейтинг LMSpeed#3
Оценка57.2
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
OSWorld 2.0Доказательство V3
Рейтинг LMSpeed#13
Оценка14.2
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
JobBenchДоказательство V3
Рейтинг LMSpeed#2
Оценка54.7
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Cybench
Рейтинг LMSpeed#1
Оценка92.9
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
ExploitGymДоказательство V3
Рейтинг LMSpeed#7
Оценка0.8
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA Agentic Index
Рейтинг LMSpeed#31
Оценка27.5
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
GDPval-AA
Рейтинг LMSpeed#28
Оценка39.7
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
GDPval-AAДоказательство V3
Рейтинг LMSpeed#24
Оценка1375.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
WebArena-Verified
Рейтинг LMSpeed#1
Оценка69.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Terminal-Bench 2.1 (Vals)
Рейтинг LMSpeed#19
Оценка69.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Benchlm_agentic_deep_swe
Рейтинг LMSpeed#1
Оценка53.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA Harvey LABДоказательство V3
Рейтинг LMSpeed#4
Оценка93.1
Источникbenchlm.ai
Обновлено28 авг. 2026 г.
Достоверность2
AA EnterpriseOps-GymДоказательство V3
Рейтинг LMSpeed#7
Оценка47.2
Источникbenchlm.ai
Обновлено28 авг. 2026 г.
Достоверность2
AA AutomationBench
Рейтинг LMSpeed#17
Оценка42.8
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность2

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка5880% интервал48.8–67.33/4 Измеренные измеренияSciCode58.8%#5 / 89Coding score56.6#34 / 87
Измерения и доказательства
Генерация кода62.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
scicode · scicode · z 1.53 · q 1.00
Работа с репозиториями55.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
swe_pro · swe_pro · z 0.78 · q 1.00
Отладка и тестированиеТолько априорное
Инструментальная разработка и качество56.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
terminalbench · benchlm_coding_terminal_bench2 · z 0.85 · q 1.00
SciCodeДоказательство V3
Рейтинг LMSpeed#5
Оценка58.8%
Источникartificialanalysis.ai
Обновлено13 сент. 2026 г.
Достоверность4
Coding score
Рейтинг LMSpeed#34
Оценка56.6
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Terminal-Bench 2.0Доказательство V3
Рейтинг LMSpeed#9
Оценка80.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
SWE-bench ProДоказательство V3
Рейтинг LMSpeed#14
Оценка61.5
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA Coding Index
Рейтинг LMSpeed#20
Оценка71.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#4
Оценка58.8
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
LiveCodeBench (Vals)
Рейтинг LMSpeed#18
Оценка85.9
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
SWE-bench (Vals)
Рейтинг LMSpeed#18
Оценка82.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка57.580% интервал47.4–67.72/4 Измеренные измеренияGPQA89.8%#37 / 218HLE46.2%#14 / 216
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение61.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z 0.66 · q 1.00
gpqa · gpqa · z 0.86 · q 1.00
hle · hle · z 1.03 · q 1.00
hle · hle_no_tools · z 1.04 · q 1.00
Многошаговые ограниченияТолько априорное
Интеграция и проверка свидетельств53.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z 0.28 · q 1.00
mrcr · mrcr1m · z 0.17 · q 0.75
GPQAДоказательство V3
Рейтинг LMSpeed#37
Оценка89.8%
Источникartificialanalysis.ai
Обновлено13 сент. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#14
Оценка46.2%
Источникartificialanalysis.ai
Обновлено13 сент. 2026 г.
Достоверность4
MRCR 1MДоказательство V3
Рейтинг LMSpeed#5
Оценка54.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-LCRДоказательство V3
Рейтинг LMSpeed#37
Оценка77.7
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
CritPtДоказательство V3
Рейтинг LMSpeed#26
Оценка15.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Reasoning score
Рейтинг LMSpeed#25
Оценка74.4
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка63.380% интервал49.3–77.31/4 Измеренные измеренияKnowledge score90.6#3 / 83HLE w/o tools52.2#3 / 22
Измерения и доказательства
Широкие знания63.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · aa_omniscience_index · z 1.06 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 1.25 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
Knowledge scoreДоказательство V3
Рейтинг LMSpeed#3
Оценка90.6
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
HLE w/o tools
Рейтинг LMSpeed#3
Оценка52.2
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
HealthBench Professional
Рейтинг LMSpeed#4
Оценка59.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#40
Оценка34.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-GPQA Diamond
Рейтинг LMSpeed#36
Оценка89.8
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-HLE
Рейтинг LMSpeed#12
Оценка46.2
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-Omniscience IndexДоказательство V3
Рейтинг LMSpeed#9
Оценка28.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-Omniscience Accuracy
Рейтинг LMSpeed#12
Оценка52.1
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#78
Оценка50.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
GPQA Diamond (Vals)
Рейтинг LMSpeed#19
Оценка91.2
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
MMLU-Pro (Vals)
Рейтинг LMSpeed#14
Оценка88.7
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математикаТолько априорное
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка56.580% интервал40.4–72.61/4 Измеренные измеренияMultimodal Grounded score77.5#16 / 56CharXiv88.4#8 / 30
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное понимание56.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
charxiv · charxiv · z 1.01 · q 1.00
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное
Multimodal Grounded score
Рейтинг LMSpeed#16
Оценка77.5
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
CharXivДоказательство V3
Рейтинг LMSpeed#8
Оценка88.4
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
BabyVision
Рейтинг LMSpeed#2
Оценка76.3
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3
Design Arena Website
Рейтинг LMSpeed#22
Оценка1282.0
Источникbenchlm.ai
Обновлено13 сент. 2026 г.
Достоверность3

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкцийТолько априорное
Многоходовые и длинные инструкцииТолько априорное

Эндпоинты OpenRouter

1 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Meta
meta
$1.25/M$4.25/M100%undefined токенов / undefined токенов

Альтернативы и похожие модели

Также известна как

meta/muse-spark-1.1muse-spark-1.1

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API