Muse Spark 1.1 API Benchmarks, Pricing & Provider Data
Compare Muse Spark 1.1 with another model
Choose a model to open its comparison page.
Muse Spark 1.1 is a multimodal reasoning model from Meta, built for agentic tasks. It accepts text, images, video, audio, and PDF documents and returns text, with a 1M-token context...
Производительность по категориям
Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.
- Покрытие
- 5 / 8
- Методология
- V3.0
#1Знания63.3Предварительная1/4 Измеренные измерения
#2Агенты61.6РейтинговаяОбщий рейтинг #103/4 Измеренные измерения
#3Программирование58Оценка3/4 Измеренные измерения
#4Рассуждение57.5Оценка2/4 Измеренные измерения
#5Мультимодальность56.5Предварительная1/4 Измеренные измерения
Specifications
Input and output token limits for this model, plus how it ranks on long-context understanding.
Возможности
Rankings
Excels at
It's decent at
Falls behind in
Подробные оценки
Обновлено: 13 сент. 2026 г.Общее
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Overall score72.0#14 / 112DeepSWE53.3#17 / 21
Общее
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цена входных данных$1.25/M#123 / 186Цена выходных данных$4.25/M#116 / 186
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Оценка61.6#1080% интервал54.2–68.93/4 Измеренные измеренияAgentic score76.1#24 / 77Terminal-Bench 2.080.0#10 / 53
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка5880% интервал48.8–67.33/4 Измеренные измеренияSciCode58.8%#5 / 89Coding score56.6#34 / 87
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка57.580% интервал47.4–67.72/4 Измеренные измеренияGPQA89.8%#37 / 218HLE46.2%#14 / 216
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка63.380% интервал49.3–77.31/4 Измеренные измеренияKnowledge score90.6#3 / 83HLE w/o tools52.2#3 / 22
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка56.580% интервал40.4–72.61/4 Измеренные измеренияMultimodal Grounded score77.5#16 / 56CharXiv88.4#8 / 30
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Эндпоинты OpenRouter
1 эндпоинтовСторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.
| Provider endpoint | Вход | Вывод | Доступность 1 день | Задержка 30м | Пропускная способность 30м | Контекст / вывод |
|---|---|---|---|---|---|---|
Meta meta | $1.25/M | $4.25/M | 100% | — | — | undefined токенов / undefined токенов |
Альтернативы и похожие модели
GPT-5.4
gpt-5-4
OpenAI GPT-5.4 extends the GPT-5 family with stronger instruction following, deeper tool use, and improved performance on coding, math, and long-document analysis.
GPT-5.3 Codex
gpt-5-3-codex
OpenAI GPT-5.3 Codex is a code-specialized variant in the GPT-5 series, optimized for code generation, debugging, and software development tasks.
GPT-5.4 Mini
gpt-5-4-mini
OpenAI GPT-5.4 Mini is a compact language model in the GPT-5 series, optimized for quick responses and high throughput.
DeepSeek V4 Flash
deepseek-v4-flash
DeepSeek V4 Flash is a fast, cost-efficient language model in the DeepSeek V4 family, optimized for low-latency chat, coding assistance, and high-throughput API workloads while retaining strong reasoning quality.
Claude Opus 4.6
claude-opus-4-6
Anthropic Claude Opus 4.6 is the most capable Claude Opus tier, optimized for complex analysis, long-horizon coding, and high-stakes enterprise reasoning workloads.
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic Claude Sonnet 4.6 extends the Sonnet line with improved tool use, coding reliability, and long-context performance for everyday production workloads.
