OpenAI
·Released on 2025年4月16日o4 Mini High API 基准测试 价格和服务商数据
选择与 o4 Mini High 对比的模型
选择一个模型后会直接打开对应的对比页面。
LLM
OpenAI o4-mini-high is the same model as [o4-mini](/openai/o4-mini) with reasoning_effort set to high. OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient p...
质量
#65of 100
53.0
LMSpeed 评分
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
INPUT
200Ktokens
≈ 240 pages of text
OUTPUT
100Ktokens
8K128K1M4M
200K
能力
排名
擅长
详细分数
更新时间: 2026年8月20日综合
1 个指标
Overall score53.0#65 / 100
综合
1 个指标
基准
站内排名
分数
来源
更新时间
置信度
智能体
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
智能体
V3.00 个指标 · 暂无数据
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验
代码
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
代码
V3.00 个指标 · 暂无数据
维度与证据
代码生成仅先验
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
综合推理
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
综合推理
V3.00 个指标 · 暂无数据
维度与证据
抽象逻辑仅先验
科学与因果推理仅先验
多步约束仅先验
证据整合与验证仅先验
知识
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
知识
V3.00 个指标 · 暂无数据
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
数学
V3.03 个指标 · 暂定评分
分数51.780% 区间35.7–67.81/4 实测维度Math score43.4#40 / 62FrontierMath v2 (Tiers 1-3)24.8#24 / 47
数学
V3.03 个指标 · 暂定评分
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明51.7
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.00 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.03 · q 1.00
应用与工具辅助数学仅先验
基准
站内排名
分数
来源
更新时间
置信度
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验
指令遵循
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
指令遵循
V3.00 个指标 · 暂无数据
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验
OpenRouter 端点
1 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
OpenAI openai | $1.10/M | $4.40/M | 100% | — | — | undefined tokens / undefined tokens |
