Muse Spark 1.1 API 基准测试 价格和服务商数据
选择与 Muse Spark 1.1 对比的模型
选择一个模型后会直接打开对应的对比页面。
Muse Spark 1.1 is a multimodal reasoning model from Meta, built for agentic tasks. It accepts text, images, video, audio, and PDF documents and returns text, with a 1M-token context...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 5 / 8
- 方法论
- V3.0
#1知识63.3暂定评分1/4 实测维度
#2智能体61.6正式评分全站排名 #103/4 实测维度
#3代码58估算3/4 实测维度
#4综合推理57.5估算2/4 实测维度
#5多模态56.5暂定评分1/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
表现尚可
相对落后
详细分数
更新时间: 2026年9月13日综合
2 个指标
Overall score72.0#14 / 112DeepSWE53.3#17 / 21
综合
2 个指标
价格
2 个指标
输入价格$1.25/M#123 / 186输出价格$4.25/M#116 / 186
价格
2 个指标
智能体
V3.021 个指标 · 正式评分
分数61.6#1080% 区间54.2–68.93/4 实测维度Agentic score76.1#24 / 77Terminal-Bench 2.080.0#10 / 53
智能体
V3.021 个指标 · 正式评分
代码
V3.08 个指标 · 估算
分数5880% 区间48.8–67.33/4 实测维度SciCode58.8%#5 / 89Coding score56.6#34 / 87
代码
V3.08 个指标 · 估算
综合推理
V3.06 个指标 · 估算
分数57.580% 区间47.4–67.72/4 实测维度GPQA89.8%#37 / 218HLE46.2%#14 / 216
综合推理
V3.06 个指标 · 估算
知识
V3.011 个指标 · 暂定评分
分数63.380% 区间49.3–77.31/4 实测维度Knowledge score90.6#3 / 83HLE w/o tools52.2#3 / 22
知识
V3.011 个指标 · 暂定评分
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.04 个指标 · 暂定评分
分数56.580% 区间40.4–72.61/4 实测维度Multimodal Grounded score77.5#16 / 56CharXiv88.4#8 / 30
多模态
V3.04 个指标 · 暂定评分
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
OpenRouter 端点
1 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
Meta meta | $1.25/M | $4.25/M | 100% | — | — | undefined tokens / undefined tokens |
替代方案与相似模型
GPT-5.4
gpt-5-4
OpenAI 的 GPT-5.4是语言模型,专为通用对话与文本生成任务优化。
GPT-5.3 Codex
gpt-5-3-codex
OpenAI 的 GPT-5.3 Codex是GPT-5.3 系列的代码专精模型,专为代码生成、调试与软件开发任务优化。
GPT-5.4 Mini
gpt-5-4-mini
OpenAI 的 GPT-5.4 Mini是GPT-5.4 系列的轻量语言模型,专为低延迟、低成本的通用对话任务优化。
DeepSeek V4 Flash
deepseek-v4-flash
DeepSeek V4 Flash是DeepSeek V4 系列的语言模型,专为通用对话与文本生成任务优化。
Claude Opus 4.6
claude-opus-4-6
Anthropic 的 Claude Opus 4.6是语言模型,专为通用对话与文本生成任务优化。
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。
