数据点: 116
Model compare
Gemini 3.1 Pro vs GPT-5.1
Gemini 3.1 Pro 和 GPT-5.1 的结论先放在这里,方便先判断是否值得继续看明细。
Key Takeaways
综合加权结果:Gemini 3.1 Pro。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。
结论
Gemini 3.1 Pro
Gemini 3.1 Pro 当前综合加权更高;模型 A / B 得分为 92 对 8。
证据覆盖
116 个数据点
包含 26 个 benchmark、0 个 audit 样本和 10 个 provider 样本。
选择依据
优先看 Gemini 3.1 Pro
下方图表把 36 组高信号样本拆开,便于核对速度、跑分和安全分。
切换对比模型
左右两边都可以换成其他模型,页面会打开新的 LMSpeed 对比 URL。
选择其他模型后会打开新的对比页。
对比总表
这份报告只使用 LMSpeed 已有数据:Gemini 3.1 Pro 和 GPT-5.1 的价格、测速聚合、第三方跑分与共同服务商样本。
| Model compare | Gemini 3.1 Pro | GPT-5.1 |
|---|---|---|
| 综合领先 | 领先 | 对照 |
| 综合加权得分 | 92.0 分 | 8.0 分 |
| Benchmark 分类领先 | 7 类 | 0 类 |
| 运营维度优势 | 平均速度、免费服务商、服务商覆盖 | 最低输入价格、首 token 延迟 |
| 上下文窗口 | 1.0M tokens | 400K tokens |
| 最大输出 | 65.5K tokens | 128K tokens |
| 模态 | 输入 音频文件图像文本video 输出 文本 | 输入 图像文本文件 输出 文本 |
| 能力 | 文本输入图像输入文件输入音频输入文本输出工具调用结构化输出JSON 模式推理 | 文本输入图像输入文件输入文本输出工具调用结构化输出JSON 模式推理 |
总体结果按 80% benchmark 能力分类和 20% 价格、API 速度/延迟与可用性加权;近期测试数量不参与胜负,缺失的 benchmark 分类不计分。
模型元信息
模型元信息
| Model compare | Gemini 3.1 Pro | GPT-5.1 |
|---|---|---|
| 开发者 | OpenAI | |
| 发布日期 | 2026年2月 | 2025年11月 |
| 参数量 | 暂无数据 | 暂无数据 |
| Tokenizer | Gemini | GPT |
| 知识截止 | 暂无数据 | 暂无数据 |
| OpenRouter ID | google/gemini-3.1-pro-preview | openai/gpt-5.1 |
| 来源链接 | 暂无数据 | 暂无数据 |
什么时候选哪个模型
这份报告只使用 LMSpeed 已有数据:Gemini 3.1 Pro 和 GPT-5.1 的价格、测速聚合、第三方跑分与共同服务商样本。
Gemini 3.1 Pro
Gemini 3.1 Pro 在 benchmark 分类(Agents、代码、推理、知识、数学)和运营维度(平均速度、免费服务商、服务商覆盖)更强。
GPT-5.1
GPT-5.1 的运营优势是:最低输入价格、首 token 延迟。
跑分对比
来自 LMSpeed 同步的第三方 benchmark profile;只展示两个模型都有数值的指标。
分类能力对比
按 0-100 分对比 benchmark 分类表现;点击分类可以聚焦查看差距。
- 模型 A 覆盖
- 8 / 8
- 模型 B 覆盖
- 7 / 8
- 共同覆盖
- 7 个共同分类
平均分
Gemini 3.1 Pro
57
平均分
GPT-5.1
51.1
Agents
Gemini 3.1 Pro 领先 2.9
代码
Gemini 3.1 Pro 领先 7.6
推理
Gemini 3.1 Pro 领先 3.6
知识
Gemini 3.1 Pro 领先 5.6
数学
Gemini 3.1 Pro 领先 1.2
多语言
Gemini 3.1 Pro
多模态
Gemini 3.1 Pro 领先 6.3
指令遵循
Gemini 3.1 Pro 领先 1.7
专业跑分明细
按具体 benchmark 指标对比两个模型,展示来源、排名覆盖、置信度、误差和评测日期等上下文。
专业跑分明细
按具体 benchmark 指标对比两个模型,展示来源、排名覆盖、置信度、误差和评测日期等上下文。
Gemini 3.1 Pro
领先67.0
排名 #27/112 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
66.0
排名 #32/112 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先82.0
排名 #14/106 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
80.0
排名 #24/106 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
50.6
排名 #60/67 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
领先76.0
排名 #17/67 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先17.7
排名 #19/88 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
4.9
排名 #48/88 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先58.7
排名 #6/113 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
43.3
排名 #60/113 · confidence 3 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先32.0
排名 #13/33 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
24.6
排名 #18/33 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先68.8
排名 #25/75 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
49.4
排名 #47/75 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先16.7
排名 #14/36 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
12.5
排名 #17/36 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先36.9
排名 #15/47 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
31.0
排名 #19/47 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先54.3
排名 #35/63 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
49.2
排名 #37/63 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先94.1
排名 #5/113 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
87.3
排名 #48/113 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先31.9
排名 #5/45 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
5.4
排名 #29/45 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先54.9
排名 #9/106 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
37.7
排名 #43/106 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先47.0
排名 #10/114 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
28.5
排名 #52/114 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先79.2
排名 #20/83 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
63.6
排名 #55/83 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先30.4
排名 #48/117 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
24.7
排名 #67/117 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
50.9
排名 #76/106 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
领先51.9
排名 #74/106 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先82.4
排名 #8/68 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
75.5
排名 #30/68 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先79.2
排名 #14/56 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
71.2
排名 #25/56 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先1265.0
排名 #32/78 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
1199.0
排名 #51/78 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先77.1
排名 #7/84 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
72.9
排名 #26/84 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先56.9
排名 #14/49 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
41.2
排名 #34/49 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
领先95.6
排名 #17/82 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
81.9
排名 #53/82 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
10.3
排名 #55/70 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
领先21.6
排名 #45/70 · confidence 3 · 评测日期 2025-11-13
Gemini 3.1 Pro
20.2
排名 #54/66 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
领先21.5
排名 #52/66 · confidence 2 · 评测日期 2025-11-13
Gemini 3.1 Pro
904.0
排名 #55/72 · confidence 3 · 评测日期 2026-02-19
GPT-5.1
领先930.0
排名 #53/72 · confidence 2 · 评测日期 2025-11-13
API audit 对比
来自共同 provider 的最近完成 audit,展示四个安全/完整性分组分数和报告入口。
API audit 对比
来自共同 provider 的最近完成 audit,展示四个安全/完整性分组分数和报告入口。
| Provider | Gemini 3.1 Pro | GPT-5.1 |
|---|---|---|
| 暂无共同 provider 的已完成 audit。 | ||
Provider 数据样本
把同一 provider 的测速聚合和 input/output 价格放进同一行,便于判断实际 API 表现和迁移成本。
Provider 数据样本
把同一 provider 的测速聚合和 input/output 价格放进同一行,便于判断实际 API 表现和迁移成本。
| Provider | Gemini 3.1 Pro | GPT-5.1 |
|---|---|---|
CatClaw API10 次测试 | Gemini 3.1 Pro speed / latency 121 tok/s / 11404ms input / output 暂无数据 | GPT-5.1 speed / latency N/A / N/A input / output 暂无数据 |
TradingBase API10 次测试 | Gemini 3.1 Pro speed / latency 102 tok/s / 12933ms input / output 暂无数据 | GPT-5.1 speed / latency N/A / N/A input / output 暂无数据 |
小水管 API10 次测试 | Gemini 3.1 Pro speed / latency 101 tok/s / 15025ms input / output 暂无数据 | GPT-5.1 speed / latency N/A / N/A input / output 暂无数据 |
AIHubMix5 次测试 | Gemini 3.1 Pro speed / latency 70 tok/s / 25059ms input / output 暂无数据 | GPT-5.1 speed / latency N/A / N/A input / output 暂无数据 |
Hi API5 次测试 | Gemini 3.1 Pro speed / latency 70 tok/s / 23273ms input / output 暂无数据 | GPT-5.1 speed / latency N/A / N/A input / output 暂无数据 |
Gemini 3.1 Pro gemini-3.1-pro-preview-high speed / latency 暂无数据 input / output $0/request | GPT-5.1 gpt-5.1-chat-latest speed / latency 暂无数据 input / output $0/request | |
Gemini 3.1 Pro gemini-3.1-pro-low speed / latency 暂无数据 input / output $0.137/M/$0.822/M | GPT-5.1 gpt-5.1 speed / latency 暂无数据 input / output $0.0014/request | |
Gemini 3.1 Pro gemini-3.1-pro-preview speed / latency 暂无数据 input / output $0.0052/request | GPT-5.1 gpt-5.1 speed / latency 暂无数据 input / output $0.0068/request | |
Gemini 3.1 Pro gemini-3.1-pro-preview-c speed / latency 暂无数据 input / output $0.0055/request | GPT-5.1 gpt-5.1-chat speed / latency 暂无数据 input / output $0.137/M/$1.10/M | |
Gemini 3.1 Pro gemini-3.1-pro-preview speed / latency 暂无数据 input / output $0.044/M/$0.262/M | GPT-5.1 gpt-5.1 speed / latency 暂无数据 input / output $0.014/M/$0.109/M |
常见问题
综合加权结果:Gemini 3.1 Pro。Benchmark 能力分类占 80%,价格、API 性能和可用性占 20%。
- 这个比较为什么能收录?
- 它至少有 6 个可验证比较点,并且两个模型都有价格或测速数据。
- 没有数据的指标会不会编?
- 不会。没有 LMSpeed 数据的指标不会出现在这份报告里。
