Ring Flash 2.0 API 基准测试 价格和服务商数据
选择与 Ring Flash 2.0 对比的模型
选择一个模型后会直接打开对应的对比页面。
LLM
页面同时展示实测速度和首字延迟。
Ring Flash 2.0是Ring 系列的语言模型,专为通用对话与文本生成任务优化。
速度
107char/s
6.09 s
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 3 / 8
- 方法论
- V3.0
#1数学51.9暂定评分1/4 实测维度
80% 区间: 35.8–68.1
foundational math51.9
aa_math_index · artificial_analysis_math_index
competition math仅先验
proof frontier仅先验
applied tool math仅先验
#2综合推理49.6估算2/4 实测维度
80% 区间: 38.4–60.7
abstract logic仅先验
scientific causal48.2
gpqa · gpqa / hle · hle
multistep constraints50.9
mmlu_pro · mmlu_pro
evidence verification仅先验
#3代码38.6暂定评分1/4 实测维度
80% 区间: 24.7–52.6
code generation38.6
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
暂无数据:智能体知识多语言多模态指令遵循
技术规格
排名
擅长
详细分数
更新时间: 2026年9月1日价格
2 个指标
输入价格$0.140/M#20 / 181输出价格$0.570/M#25 / 181
价格
2 个指标
基准
站内排名
分数
来源
更新时间
置信度
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验
代码
V3.02 个指标 · 暂定评分
分数38.680% 区间24.7–52.61/4 实测维度LiveCodeBench62.8%#40 / 115SciCode16.8%#202 / 206
代码
V3.02 个指标 · 暂定评分
维度与证据
代码生成38.6
2 个基准族 · 2 个指标
livecodebench · livecodebench · z 0.39 · q 1.00
scicode · scicode · z -2.43 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
基准
站内排名
分数
来源
更新时间
置信度
综合推理
V3.03 个指标 · 估算
分数49.680% 区间38.4–60.72/4 实测维度MMLU-Pro79.3%#68 / 129GPQA72.5%#131 / 213
综合推理
V3.03 个指标 · 估算
维度与证据
抽象逻辑仅先验
科学与因果推理48.2
2 个基准族 · 2 个指标
gpqa · gpqa · z -0.23 · q 1.00
hle · hle · z -0.27 · q 1.00
多步约束50.9
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -0.08 · q 1.00
证据整合与验证仅先验
基准
站内排名
分数
来源
更新时间
置信度
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
数学
V3.00 个指标 · 暂定评分
分数51.980% 区间35.8–68.11/4 实测维度
数学
V3.00 个指标 · 暂定评分
维度与证据
基础数学51.9
1 个基准族 · 1 个指标
aa_math_index · artificial_analysis_math_index · z 0.66 · q 1.00
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验
替代方案与相似模型
GLM-4.6
glm-4-6
Zhipu 的 GLM-4.6是语言模型,专为通用对话与文本生成任务优化。
13 个共享提供商
Kimi K2.5
kimi-k2-5
Moonshot 的 Kimi K2.5是语言模型,专为通用对话与文本生成任务优化。
12 个共享提供商
GLM-5
glm-5
Zhipu 的 GLM-5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
12 个共享提供商
DeepSeek V3.2
deepseek-v3-2
DeepSeek V3.2是语言模型,专为通用对话与文本生成任务优化。
12 个共享提供商
MiniMax M2.5
minimax-m2-5
MiniMax M2.5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
12 个共享提供商
GLM-4.7
glm-4-7
Zhipu 的 GLM-4.7是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
12 个共享提供商
