Back to models

Model compare

GPT-4o vs O3 Mini

Краткий вывод по GPT-4o и O3 Mini перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: O3 Mini. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

O3 Mini

O3 Mini имеет более высокий взвешенный результат; баллы модели A / B — 46.7 к 53.3.

Глубина данных

98 точек данных

Включает 16 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с O3 Mini

Графики ниже разделяют 26 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for GPT-4o and O3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
GPT-4o
O3 Mini
Overall leaderContenderLeading
Итоговый взвешенный балл46.7 балла53.3 балла
Лидерство в категориях benchmark2 категорий4 категорий
Операционные преимуществаCheapest input price, Average speed, First-token latency, Free providers, Provider coverageNo data
Контекстное окно128K токенов200K токенов
Макс. вывод16.4K токенов100K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимВеб-поиск
Текст на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
GPT-4o
O3 Mini
РазработчикOpenAIOpenAI
Выпущенанояб. 2024 г.февр. 2025 г.
ПараметрыNo dataNo data
ТокенизаторGPTGPT
Срез знаний2023-10-312023-10-31
OpenRouter IDopenai/gpt-4oopenai/o3-mini
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for GPT-4o and O3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

GPT-4o

GPT-4o сильнее в категориях benchmark (Кодинг, Знания) и операционных измерениях (Cheapest input price, Average speed, First-token latency, Free providers, Provider coverage).

O3 Mini

O3 Mini лидирует в категориях benchmark: Агенты, Reasoning, Математика, Следование инструкциям.

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
6 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

GPT-4o

43

Средний балл

O3 Mini

48.6

Агенты

O3 Mini впереди на 0.7

GPT-4o39
O3 Mini39.7

Кодинг

GPT-4o впереди на 5.5

GPT-4o46
O3 Mini40.5

Reasoning

O3 Mini впереди на 9.5

GPT-4o39.9
O3 Mini49.4

Знания

GPT-4o впереди на 1.2

GPT-4o49
O3 Mini47.8

Математика

O3 Mini впереди на 16.3

GPT-4o42.2
O3 Mini58.5

Многоязычность

Нет данных

GPT-4o-
O3 Mini-

Мультимодальность

Нет данных

GPT-4o-
O3 Mini-

Следование инструкциям

O3 Mini впереди на 14.0

GPT-4o41.6
O3 Mini55.6

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникGPT-4o

GPT-4o

43.0

Ранг #91/100 · confidence 1 · дата оценки 2024-05-13

+8.0

O3 Mini

лидер

51.0

Ранг #67/100 · confidence 1 · дата оценки 2025-01-31

Ценыverified

Input price

ИсточникGPT-4o (Nov '24)

GPT-4o

$2.50/M

Ранг #150/180 · confidence 4

+$1.40/M

O3 Mini

лидер

$1.10/M

Ранг #114/180 · confidence 4

Ценыverified

Blended price

ИсточникGPT-4o (Nov '24)

GPT-4o

$4.38/M

Ранг #145/180 · confidence 4

+$2.45/M

O3 Mini

лидер

$1.93/M

Ранг #115/180 · confidence 4

Ценыverified

Output price

ИсточникGPT-4o (Nov '24)

GPT-4o

$10.00/M

Ранг #138/180 · confidence 4

+$5.60/M

O3 Mini

лидер

$4.40/M

Ранг #115/180 · confidence 4

Reasoningverified

MMLU-Pro

ИсточникGPT-4o (Nov '24)

GPT-4o

74.8%

Ранг #90/129 · confidence 4

+4.3%

O3 Mini

лидер

79.1%

Ранг #70/129 · confidence 4

Reasoningverified

GPQA

ИсточникGPT-4o (Nov '24)

GPT-4o

54.3%

Ранг #178/212 · confidence 4

+20.5%

O3 Mini

лидер

74.8%

Ранг #117/212 · confidence 4

Reasoningverified

HLE

ИсточникGPT-4o (Nov '24)

GPT-4o

2.4%

Ранг #207/209 · confidence 4

+5.5%

O3 Mini

лидер

7.9%

Ранг #128/209 · confidence 4

Кодингverified

LiveCodeBench

ИсточникGPT-4o (Nov '24)

GPT-4o

30.9%

Ранг #88/115 · confidence 4

+40.8%

O3 Mini

лидер

71.7%

Ранг #27/115 · confidence 4

Кодингreported

AA-SciCode

ИсточникGPT-4o

GPT-4o

33.3

Ранг #91/108 · confidence 1 · дата оценки 2024-05-13

+6.6

O3 Mini

лидер

39.9

Ранг #70/108 · confidence 1 · дата оценки 2025-01-31

Кодингverified

SciCode

ИсточникGPT-4o (Nov '24)

GPT-4o

33.3%

Ранг #138/205 · confidence 4

+6.6%

O3 Mini

лидер

39.9%

Ранг #86/205 · confidence 4

Математикаverified

MATH-500

ИсточникGPT-4o (Nov '24)

GPT-4o

75.9%

Ранг #55/73 · confidence 4

+21.4%

O3 Mini

лидер

97.3%

Ранг #11/73 · confidence 4

Математикаverified

AIME

ИсточникGPT-4o (Nov '24)

GPT-4o

15.0%

Ранг #50/68 · confidence 4

+62.0%

O3 Mini

лидер

77.0%

Ранг #14/68 · confidence 4

Знанияreported

AA-GPQA Diamond

ИсточникGPT-4o

GPT-4o

54.3

Ранг #102/108 · confidence 1 · дата оценки 2024-05-13

+20.5

O3 Mini

лидер

74.8

Ранг #82/108 · confidence 1 · дата оценки 2025-01-31

Знанияreported

AA-HLE

ИсточникGPT-4o

GPT-4o

2.4

Ранг #108/108 · confidence 1 · дата оценки 2024-05-13

+5.5

O3 Mini

лидер

7.9

Ранг #83/108 · confidence 1 · дата оценки 2025-01-31

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGPT-4o

GPT-4o

11.1

Ранг #101/111 · confidence 1 · дата оценки 2024-05-13

+8.1

O3 Mini

лидер

19.2

Ранг #87/111 · confidence 1 · дата оценки 2025-01-31

Агентыreported

τ²-bench results

ИсточникGPT-4o

GPT-4o

25.1

Ранг #73/82 · confidence 1 · дата оценки 2024-05-13

+3.6

O3 Mini

лидер

28.7

Ранг #72/82 · confidence 1 · дата оценки 2025-01-31

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
GPT-4o
O3 Mini
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
GPT-4o
O3 Mini
丸美小沐30 tests

GPT-4o

speed / latency

135 tok/s / 1427ms

input / output

No data

O3 Mini

speed / latency

66 tok/s / 6491ms

input / output

No data

速创API20 tests

GPT-4o

speed / latency

88 tok/s / 1593ms

input / output

No data

O3 Mini

speed / latency

N/A / N/A

input / output

No data

GPT-4o

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

44 tok/s / 17418ms

input / output

No data

KFCV505 tests

GPT-4o

speed / latency

48 tok/s / 13138ms

input / output

No data

O3 Mini

speed / latency

N/A / N/A

input / output

No data

N1N5 tests

GPT-4o

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

117 tok/s / 4809ms

input / output

No data

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0/request

O3 Mini

o3-mini

speed / latency

No data

input / output

$0/request

GPT-4o

gpt-4o-all-c

speed / latency

No data

input / output

$0.0074/request

O3 Mini

o3-mini-all

speed / latency

No data

input / output

$0.0062/request

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0.0066/request

O3 Mini

o3-mini-high-all

speed / latency

No data

input / output

$0.011/request

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0.0066/request

O3 Mini

o3-mini-high-all

speed / latency

No data

input / output

$0.011/request

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0.0099/request

O3 Mini

o3-mini-high-all

speed / latency

No data

input / output

$0.016/request

FAQ

Взвешенный результат: O3 Mini. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.