Claude Fable 5.1 API 基准测试 价格和服务商数据
选择与 Claude Fable 5.1 对比的模型
选择一个模型后会直接打开对应的对比页面。
Claude Fable 5.1 improves on Claude Fable 5 across the board, with the biggest gains in agentic coding, long-running agentic workflows, and knowledge work: long code refactors, front-end and visual...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 4 / 8
- 方法论
- V3.0
#1知识68.7暂定评分1/4 实测维度
#2代码67.9正式评分全站排名 #14/4 实测维度
#3智能体64.4正式评分全站排名 #43/4 实测维度
#4综合推理61.3正式评分全站排名 #13/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
相对落后
详细分数
更新时间: 2026年9月2日综合
2 个指标
Overall score79.0#4 / 101DeepSWE67.4#5 / 17
综合
2 个指标
速度与延迟
2 个指标
输出速度61.4 tok/s#54 / 78首字延迟16.07 s#69 / 78
速度与延迟
2 个指标
价格
2 个指标
输入价格$10.00/M#172 / 182输出价格$50.00/M#173 / 182
价格
2 个指标
智能体
V3.015 个指标 · 正式评分
分数64.4#480% 区间55.8–73.03/4 实测维度Agentic score85.0#7 / 70Terminal-Bench 4.055.8#1 / 1
智能体
V3.015 个指标 · 正式评分
代码
V3.010 个指标 · 正式评分
分数67.9#180% 区间61.0–74.84/4 实测维度SciCode57.6%#5 / 207Coding score80.3#4 / 82
代码
V3.010 个指标 · 正式评分
综合推理
V3.07 个指标 · 正式评分
分数61.3#180% 区间52.6–70.03/4 实测维度GPQA90.6%#26 / 214HLE55.9%#3 / 211
综合推理
V3.07 个指标 · 正式评分
知识
V3.08 个指标 · 暂定评分
分数68.780% 区间54.7–82.71/4 实测维度Knowledge score97.0#1 / 70HLE w/o tools60.9#1 / 22
知识
V3.08 个指标 · 暂定评分
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
替代方案与相似模型
GPT-5.4
gpt-5-4
OpenAI 的 GPT-5.4是语言模型,专为通用对话与文本生成任务优化。
GPT-5.3 Codex
gpt-5-3-codex
OpenAI 的 GPT-5.3 Codex是GPT-5.3 系列的代码专精模型,专为代码生成、调试与软件开发任务优化。
GPT-5.2
gpt-5-2
OpenAI 的 GPT-5.2是语言模型,专为通用对话与文本生成任务优化。
GPT-5.4 Mini
gpt-5-4-mini
OpenAI 的 GPT-5.4 Mini是GPT-5.4 系列的轻量语言模型,专为低延迟、低成本的通用对话任务优化。
Claude Opus 4.6
claude-opus-4-6
Anthropic 的 Claude Opus 4.6是语言模型,专为通用对话与文本生成任务优化。
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。
