Back to models

Model compare

O1 vs O3 Mini

Краткий вывод по O1 и O3 Mini перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: O1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

O1

O1 имеет более высокий взвешенный результат; баллы модели A / B — 53.3 к 46.7.

Глубина данных

102 точек данных

Включает 19 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с O1

Графики ниже разделяют 29 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for O1 and O3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
O1
O3 Mini
Overall leaderLeadingContender
Итоговый взвешенный балл53.3 балла46.7 балла
Лидерство в категориях benchmark4 категорий2 категорий
Операционные преимуществаNo dataCheapest input price, Free providers, Provider coverage
Контекстное окно200K токенов200K токенов
Макс. вывод100K токенов100K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
O1
O3 Mini
РазработчикOpenAIOpenAI
Выпущенадек. 2024 г.февр. 2025 г.
ПараметрыNo dataNo data
ТокенизаторGPTGPT
Срез знаний2023-10-312023-10-31
OpenRouter IDopenai/o1openai/o3-mini
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for O1 and O3 Mini: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

O1

O1 лидирует в категориях benchmark: Агенты, Кодинг, Reasoning, Знания.

O3 Mini

O3 Mini сильнее в категориях benchmark (Математика, Следование инструкциям) и операционных измерениях (Cheapest input price, Free providers, Provider coverage).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
6 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

O1

52.2

Средний балл

O3 Mini

48.5

Агенты

O1 впереди на 5.8

O145.5
O3 Mini39.7

Кодинг

O1 впереди на 10.2

O150.5
O3 Mini40.3

Reasoning

O1 впереди на 1.4

O150.7
O3 Mini49.3

Знания

O1 впереди на 14.7

O162.5
O3 Mini47.8

Математика

O3 Mini впереди на 5.9

O152.6
O3 Mini58.5

Многоязычность

Нет данных

O1-
O3 Mini-

Мультимодальность

Нет данных

O1-
O3 Mini-

Следование инструкциям

O3 Mini впереди на 4.1

O151.5
O3 Mini55.6

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Ценыverified

Input price

Источникo1

O1

$15.00/M

Ранг #177/184 · confidence 4

+$13.90/M

O3 Mini

лидер

$1.10/M

Ранг #116/184 · confidence 4

Ценыverified

Blended price

Источникo1

O1

$26.25/M

Ранг #177/184 · confidence 4

+$24.32/M

O3 Mini

лидер

$1.93/M

Ранг #117/184 · confidence 4

Ценыverified

Output price

Источникo1

O1

$60.00/M

Ранг #177/184 · confidence 4

+$55.60/M

O3 Mini

лидер

$4.40/M

Ранг #119/184 · confidence 4

Reasoningverified

MMLU-Pro

Источникo1

O1

лидер

84.1%

Ранг #34/129 · confidence 4

+5.0%

O3 Mini

79.1%

Ранг #70/129 · confidence 4

Reasoningverified

GPQA

Источникo1

O1

74.7%

Ранг #123/216 · confidence 4

+0.1%

O3 Mini

лидер

74.8%

Ранг #120/216 · confidence 4

Reasoningverified

HLE

Источникo1

O1

7.0%

Ранг #139/213 · confidence 4

+0.9%

O3 Mini

лидер

7.9%

Ранг #132/213 · confidence 4

Кодингverified

LiveCodeBench

Источникo1

O1

67.9%

Ранг #34/115 · confidence 4

+3.8%

O3 Mini

лидер

71.7%

Ранг #27/115 · confidence 4

Кодингreported

AA-SciCode

Источникo1

O1

35.8

Ранг #87/109 · confidence 1 · дата оценки 2024-12-01

+4.1

O3 Mini

лидер

39.9

Ранг #71/109 · confidence 1 · дата оценки 2025-01-31

Кодингverified

SciCode

Источникo1

O1

35.8%

Ранг #127/209 · confidence 4

+4.1%

O3 Mini

лидер

39.9%

Ранг #89/209 · confidence 4

Математикаverified

MATH-500

Источникo1

O1

97.0%

Ранг #13/73 · confidence 4

+0.3%

O3 Mini

лидер

97.3%

Ранг #11/73 · confidence 4

Математикаverified

AIME

Источникo1

O1

72.3%

Ранг #19/68 · confidence 4

+4.7%

O3 Mini

лидер

77.0%

Ранг #14/68 · confidence 4

Знанияreported

MMLU

Источникo1

O1

лидер

91.8

Ранг #1/5 · confidence 1 · дата оценки 2024-12-01

+4.9

O3 Mini

86.9

Ранг #4/5 · confidence 1 · дата оценки 2025-01-31

Знанияreported

BenchLM Knowledge score

Источникo1

O1

64.0

Ранг #44/70 · confidence 1 · дата оценки 2024-12-01

+1.6

O3 Mini

лидер

65.6

Ранг #38/70 · confidence 1 · дата оценки 2025-01-31

Знанияreported

AA-GPQA Diamond

Источникo1

O1

74.7

Ранг #85/109 · confidence 1 · дата оценки 2024-12-01

+0.1

O3 Mini

лидер

74.8

Ранг #83/109 · confidence 1 · дата оценки 2025-01-31

Знанияreported

AA-HLE

Источникo1

O1

7.0

Ранг #86/109 · confidence 1 · дата оценки 2024-12-01

+0.9

O3 Mini

лидер

7.9

Ранг #84/109 · confidence 1 · дата оценки 2025-01-31

Знанияreported

Artificial Analysis Intelligence Index

Источникo1-preview

O1

17.2

Ранг #91/112 · confidence 1 · дата оценки 2024-09-12

+2.0

O3 Mini

лидер

19.2

Ранг #88/112 · confidence 1 · дата оценки 2025-01-31

Следование инструкциямreported

IFEval

Источникo1

O1

92.2

Ранг #10/16 · confidence 1 · дата оценки 2024-12-01

+1.7

O3 Mini

лидер

93.9

Ранг #5/16 · confidence 1 · дата оценки 2025-01-31

Следование инструкциямreported

BenchLM Instruction Following score

Источникo1

O1

86.1

Ранг #15/25 · confidence 1 · дата оценки 2024-12-01

+4.9

O3 Mini

лидер

91.0

Ранг #7/25 · confidence 1 · дата оценки 2025-01-31

Агентыreported

τ²-bench results

Источникo1

O1

лидер

62.6

Ранг #61/82 · confidence 1 · дата оценки 2024-12-01

+33.9

O3 Mini

28.7

Ранг #72/82 · confidence 1 · дата оценки 2025-01-31

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
O1
O3 Mini
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
O1
O3 Mini

O1

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

44 tok/s / 17418ms

input / output

No data

N1N5 tests

O1

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

117 tok/s / 4809ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

N/A / N/A

input / output

No data

AAAI0 tests

O1

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

N/A / N/A

input / output

No data

AASS API0 tests

O1

speed / latency

N/A / N/A

input / output

No data

O3 Mini

speed / latency

N/A / N/A

input / output

No data

O1

o1-2024-12-17

speed / latency

No data

input / output

$0/request

O3 Mini

o3-mini

speed / latency

No data

input / output

$0/request

O1

o1-all

speed / latency

No data

input / output

$0.062/request

O3 Mini

o3-mini-all

speed / latency

No data

input / output

$0.0062/request

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

O3 Mini

o3-mini-high-all

speed / latency

No data

input / output

$0.011/request

O1

o1-all

speed / latency

No data

input / output

$0.082/request

O3 Mini

o3-mini-high

speed / latency

No data

input / output

$0.011/request

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

O3 Mini

o3-mini-high-all

speed / latency

No data

input / output

$0.011/request

FAQ

Взвешенный результат: O1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 4 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.