OpenAI
·Released on 16 апр. 2025 г.

o4 Mini High API Benchmarks, Pricing & Provider Data

Compare o4 Mini High with another model

Choose a model to open its comparison page.

Share on X
LLM

OpenAI o4-mini-high is the same model as [o4-mini](/openai/o4-mini) with reasoning_effort set to high. OpenAI o4-mini is a compact reasoning model in the o-series, optimized for fast, cost-efficient p...

Качество
#65of 100
53.0
Оценка LMSpeed

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
1 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты-Программирование-Рассуждение-Знания-Математика51.7Многоязычность-Мультимодальность-Следование инструкциям-
#1Математика51.7Предварительная1/4 Измеренные измерения
80% интервал: 35.767.8
foundational mathТолько априорное
competition mathТолько априорное
proof frontier51.7
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool mathТолько априорное
Нет данных:АгентыПрограммированиеРассуждениеЗнанияМногоязычностьМультимодальностьСледование инструкциям

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
200Ktokens
240 pages of text
OUTPUT
100Ktokens
8K128K1M4M
200K

Возможности

Technical Details

Вход
Выход
Выпущена
Apr 2025
Срез знаний
2024-06-30
Документация
Токенизатор
GPT
Архитектура
text+image+file->text
Модерация
Да
Поддерживаемые параметры
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

Rankings

Excels at

Подробные оценки

Обновлено: 20 авг. 2026 г.

Общее

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Overall score53.0#65 / 100
Overall score
Рейтинг LMSpeed#65
Оценка53.0
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментовТолько априорное
Среда и длительное выполнениеТолько априорное
Восстановление и надёжность завершенияТолько априорное

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Генерация кодаТолько априорное
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждениеТолько априорное
Многошаговые ограниченияТолько априорное
Интеграция и проверка свидетельствТолько априорное

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Широкие знанияТолько априорное
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка51.780% интервал35.7–67.81/4 Измеренные измеренияMath score43.4#40 / 62FrontierMath v2 (Tiers 1-3)24.8#24 / 47
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математикаТолько априорное
Продвинутые доказательства51.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
frontiermath · frontier_math_v2_tier4 · z 0.00 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.03 · q 1.00
Прикладная математика и инструментыТолько априорное
Math score
Рейтинг LMSpeed#40
Оценка43.4
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
FrontierMath v2 (Tiers 1-3)Доказательство V3
Рейтинг LMSpeed#24
Оценка24.8
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1
FrontierMath v2 (Tier 4)Доказательство V3
Рейтинг LMSpeed#20
Оценка6.3
Источникbenchlm.ai
Обновлено20 авг. 2026 г.
Достоверность1

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкцийТолько априорное
Многоходовые и длинные инструкцииТолько априорное

Эндпоинты OpenRouter

1 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
OpenAI
openai
$1.10/M$4.40/M100%undefined токенов / undefined токенов

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API