OpenAI
·Released on 2025年4月16日

o4 Mini High API 基准测试 价格和服务商数据

选择与 o4 Mini High 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

OpenAI o4-mini-high is the same model as [o4-mini](/openai/o4-mini) with reasoning_effort set to high. OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient p...

质量
#65of 100
53.0
LMSpeed 评分

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
1 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体-代码-综合推理-知识-数学51.7多语言-多模态-指令遵循-
#1数学51.7暂定评分1/4 实测维度
80% 区间: 35.767.8
foundational math仅先验
competition math仅先验
proof frontier51.7
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math仅先验
暂无数据:智能体代码综合推理知识多语言多模态指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
200Ktokens
240 pages of text
OUTPUT
100Ktokens
8K128K1M4M
200K

能力

Technical Details

输入
输出
发布日期
Apr 2025
知识截止
2024-06-30
官方文档
Tokenizer
GPT
架构
text+image+file->text
内容审核
支持参数
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

排名

擅长

详细分数

更新时间: 2026年8月20日

综合

1 个指标

Overall score53.0#65 / 100
Overall score
站内排名#65
分数53.0
更新时间2026年8月20日
置信度1

智能体

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
规划拆解仅先验
工具调用仅先验
环境与长程执行仅先验
恢复与完成可靠性仅先验

代码

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
代码生成仅先验
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验

综合推理

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
抽象逻辑仅先验
科学与因果推理仅先验
多步约束仅先验
证据整合与验证仅先验

知识

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
广泛知识仅先验
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验

数学

V3.0

3 个指标 · 暂定评分

分数51.780% 区间35.7–67.81/4 实测维度Math score43.4#40 / 62FrontierMath v2 (Tiers 1-3)24.8#24 / 47
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明51.7
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z 0.00 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.03 · q 1.00
应用与工具辅助数学仅先验
Math score
站内排名#40
分数43.4
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#24
分数24.8
更新时间2026年8月20日
置信度1
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#20
分数6.3
更新时间2026年8月20日
置信度1

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
OpenAI
openai
$1.10/M$4.40/M100%undefined tokens / undefined tokens

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档