IBM
·Released on 2026年8月31日Granite 4.2 8B API 基准测试 价格和服务商数据
选择与 Granite 4.2 8B 对比的模型
选择一个模型后会直接打开对应的对比页面。
LLM
Granite 4.2 8B is a dense reasoning model from IBM. It is suited for mathematics, code generation, multilingual dialogue, and agentic workflows that need multi-step reasoning. It supports full, low-ef...
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 2 / 8
- 方法论
- V3.0
#1综合推理46.2暂定评分1/4 实测维度
80% 区间: 32.3–60.1
abstract logic仅先验
scientific causal46.2
gpqa · gpqa / hle · hle
multistep constraints仅先验
evidence verification仅先验
#2代码45.4暂定评分1/4 实测维度
80% 区间: 29.5–61.4
code generation45.4
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识数学多语言多模态指令遵循
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
INPUT
131.1Ktokens
≈ 157.3 pages of text
OUTPUT
118.0Ktokens
8K128K1M4M
131.1K
能力
排名
擅长
详细分数
更新时间: 2026年9月1日速度与延迟
2 个指标
输出速度152.5 tok/s#16 / 77首字延迟0.21 s#2 / 77
速度与延迟
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
价格
2 个指标
输入价格$0.060/M#4 / 181输出价格$0.250/M#8 / 181
价格
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验
代码
V3.01 个指标 · 暂定评分
分数45.480% 区间29.5–61.41/4 实测维度SciCode30.4%#156 / 206
代码
V3.01 个指标 · 暂定评分
维度与证据
代码生成45.4
1 个基准族 · 1 个指标
scicode · scicode · z -0.73 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
基准
站内排名
分数
来源
更新时间
置信度
综合推理
V3.02 个指标 · 暂定评分
分数46.280% 区间32.3–60.11/4 实测维度GPQA63.1%#155 / 213HLE9.7%#118 / 210
综合推理
V3.02 个指标 · 暂定评分
维度与证据
抽象逻辑仅先验
科学与因果推理46.2
2 个基准族 · 2 个指标
gpqa · gpqa · z -0.64 · q 1.00
hle · hle · z -0.26 · q 1.00
多步约束仅先验
证据整合与验证仅先验
基准
站内排名
分数
来源
更新时间
置信度
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
数学
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
数学
V3.00 个指标 · 暂无数据
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验
