Muse Spark 1.3 API 基准测试 价格和服务商数据
选择与 Muse Spark 1.3 对比的模型
选择一个模型后会直接打开对应的对比页面。
Muse Spark 1.3 is a multimodal reasoning model from Meta for long-running agentic, multi-agent, and coding workflows. It is designed to keep track of information across extended tasks, work through...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 2 / 8
- 方法论
- V3.0
#1代码64暂定评分1/4 实测维度
#2综合推理63.5暂定评分1/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
详细分数
更新时间: 2026年9月4日智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
代码
V3.01 个指标 · 暂定评分
分数6480% 区间48.0–79.91/4 实测维度SciCode57.3%#6 / 209
代码
V3.01 个指标 · 暂定评分
综合推理
V3.02 个指标 · 暂定评分
分数63.580% 区间49.6–77.41/4 实测维度GPQA93.8%#6 / 216HLE49.1%#7 / 213
综合推理
V3.02 个指标 · 暂定评分
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
替代方案与相似模型
GPT-5.4
gpt-5-4
OpenAI 的 GPT-5.4是语言模型,专为通用对话与文本生成任务优化。
GPT-5.3 Codex
gpt-5-3-codex
OpenAI 的 GPT-5.3 Codex是GPT-5.3 系列的代码专精模型,专为代码生成、调试与软件开发任务优化。
GPT-5.2
gpt-5-2
OpenAI 的 GPT-5.2是语言模型,专为通用对话与文本生成任务优化。
GPT-5.4 Mini
gpt-5-4-mini
OpenAI 的 GPT-5.4 Mini是GPT-5.4 系列的轻量语言模型,专为低延迟、低成本的通用对话任务优化。
Claude Opus 4.6
claude-opus-4-6
Anthropic 的 Claude Opus 4.6是语言模型,专为通用对话与文本生成任务优化。
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。
