数据点: 80
Model compare
Kimi K2.5 和 Kimi K2 Thinking 的结论先放在这里,方便先判断是否值得继续看明细。
综合加权结果:Kimi K2 Thinking。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。
结论
Kimi K2 Thinking
Kimi K2 Thinking 当前综合加权更高;模型 A / B 得分为 46.7 对 53.3。
证据覆盖
80 个数据点
包含 7 个 benchmark、0 个 audit 样本和 7 个 provider 样本。
选择依据
优先看 Kimi K2 Thinking
下方图表把 14 组高信号样本拆开,便于核对速度、跑分和安全分。
左右两边都可以换成其他模型,页面会打开新的 LMSpeed 对比 URL。
选择其他模型后会打开新的对比页。
这份报告只使用 LMSpeed 已有数据:Kimi K2.5 和 Kimi K2 Thinking 的价格、测速聚合、第三方跑分与共同服务商样本。
| Model compare | Kimi K2.5 | Kimi K2 Thinking |
|---|
| 综合领先 | 对照 | 领先 |
|---|---|---|
| 综合加权得分 | 46.7 分 | 53.3 分 |
| Benchmark 分类领先 | 1 类 | 2 类 |
| 运营维度优势 | 最低输入价格、平均速度、首 token 延迟、免费服务商、服务商覆盖 | 暂无数据 |
| 上下文窗口 | 262.1K tokens | 262.1K tokens |
| 最大输出 | 262.1K tokens | 100.4K tokens |
| 模态 | 输入 文本图像 输出 文本 | 输入 文本 |
总体结果按 80% benchmark 能力分类和 20% 价格、API 速度/延迟与可用性加权;近期测试数量不参与胜负,缺失的 benchmark 分类不计分。
| Model compare | Kimi K2.5 | Kimi K2 Thinking |
|---|---|---|
| 开发者 | MoonshotAI | MoonshotAI |
| 发布日期 | 2026年1月 | 2025年11月 |
| 参数量 | 暂无数据 | 暂无数据 |
| Tokenizer | Other | Other |
| 知识截止 | 暂无数据 | 暂无数据 |
| OpenRouter ID | moonshotai/kimi-k2.5 | moonshotai/kimi-k2-thinking |
| 来源链接 | 暂无数据 | 暂无数据 |
这份报告只使用 LMSpeed 已有数据:Kimi K2.5 和 Kimi K2 Thinking 的价格、测速聚合、第三方跑分与共同服务商样本。
Kimi K2.5
Kimi K2.5 在 benchmark 分类(推理)和运营维度(最低输入价格、平均速度、首 token 延迟、免费服务商、服务商覆盖)更强。
Kimi K2 Thinking
Kimi K2 Thinking 在 benchmark 分类中领先:代码、数学。
来自 LMSpeed 同步的第三方 benchmark profile;只展示两个模型都有数值的指标。
按 0-100 分对比 benchmark 分类表现;点击分类可以聚焦查看差距。
平均分
Kimi K2.5
49.7
平均分
Kimi K2 Thinking
55.7
Kimi K2.5
Kimi K2 Thinking 领先 9.0
Kimi K2.5 领先 0.2
Kimi K2.5
Kimi K2 Thinking 领先 4.4
Kimi K2.5
Kimi K2.5
Kimi K2.5
按具体 benchmark 指标对比两个模型,展示来源、排名覆盖、置信度、误差和评测日期等上下文。
Kimi K2.5
$3.00/M
排名 #85/162 · confidence 4
Kimi K2 Thinking
领先$2.50/M
排名 #75/162 · confidence 4
Kimi K2.5
$1.20/M
排名 #85/162 · confidence 4
Kimi K2 Thinking
领先$1.07/M
排名 #78/162 · confidence 4
Kimi K2.5
$0.600/M
排名 #80/162 · confidence 4
Kimi K2 Thinking
$0.600/M
排名 #80/162 · confidence 4
Kimi K2.5
领先87.1%
排名 #11/125 · confidence 4 · 评测日期 2026-02-01
Kimi K2 Thinking
84.8%
排名 #28/125 · confidence 4
Kimi K2.5
12.3%
排名 #84/187 · confidence 4
Kimi K2 Thinking
领先22.3%
排名 #49/187 · confidence 4
Kimi K2.5
78.9%
排名 #79/188 · confidence 4
Kimi K2 Thinking
领先83.8%
排名 #55/188 · confidence 4
Kimi K2.5
39.6%
排名 #76/185 · confidence 4
Kimi K2 Thinking
领先42.4%
排名 #49/185 · confidence 4
来自共同 provider 的最近完成 audit,展示四个安全/完整性分组分数和报告入口。
| Provider | Kimi K2.5 | Kimi K2 Thinking |
|---|---|---|
| 暂无共同 provider 的已完成 audit。 | ||
把同一 provider 的测速聚合和 input/output 价格放进同一行,便于判断实际 API 表现和迁移成本。
| Provider | Kimi K2.5 | Kimi K2 Thinking |
|---|---|---|
150 次测试 | Kimi K2.5 speed / latency 45 tok/s / 2058ms input / output 暂无数据 | Kimi K2 Thinking speed / latency 34 tok/s / 16242ms input / output 暂无数据 |
85 次测试 | Kimi K2.5 speed / latency 48 tok/s / 18528ms input / output 暂无数据 | Kimi K2 Thinking speed / latency 41 tok/s / 19451ms input / output 暂无数据 |
30 次测试 | Kimi K2.5 speed / latency 18 tok/s / 25450ms input / output 暂无数据 | Kimi K2 Thinking speed / latency N/A / N/A input / output 暂无数据 |
25 次测试 | Kimi K2.5 speed / latency 38 tok/s / 22910ms input / output 暂无数据 | Kimi K2 Thinking speed / latency N/A / N/A input / output 暂无数据 |
10 次测试 | Kimi K2.5 speed / latency 45 tok/s / 14302ms input / output 暂无数据 | Kimi K2 Thinking speed / latency N/A / N/A input / output 暂无数据 |
Kimi K2.5 kimi-k2.5 speed / latency 暂无数据 input / output $0.041/M/$0.205/M | Kimi K2 Thinking kimi-k2-thinking speed / latency 暂无数据 input / output $0.027/M | |
Kimi K2.5 kimi-k2.5 speed / latency 暂无数据 input / output $0.010/request | Kimi K2 Thinking kimi-k2-thinking-tidy speed / latency 暂无数据 input / output $0.010/request |
综合加权结果:Kimi K2 Thinking。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。
输出
| 能力 | 文本输入图像输入文本输出工具调用结构化输出JSON 模式推理 | 文本输入文本输出工具调用结构化输出JSON 模式推理 |
|---|