Back to models

Model compare

GPT-5.4 vs O1

Краткий вывод по GPT-5.4 и O1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.4

GPT-5.4 имеет более высокий взвешенный результат; баллы модели A / B — 86.7 к 13.3.

Глубина данных

103 точек данных

Включает 20 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.4

Графики ниже разделяют 30 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for GPT-5.4 and O1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
GPT-5.4
O1
Overall leaderLeadingContender
Итоговый взвешенный балл86.7 балла13.3 балла
Лидерство в категориях benchmark5 категорий1 категорий
Операционные преимуществаCheapest input price, Free providers, Provider coverageNo data
Контекстное окно1.1M токенов200K токенов
Макс. вывод128K токенов100K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстИзображениеФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
GPT-5.4
O1
РазработчикOpenAIOpenAI
Выпущенамарт 2026 г.дек. 2024 г.
ПараметрыNo dataNo data
ТокенизаторGPTGPT
Срез знанийNo data2023-10-31
OpenRouter IDopenai/gpt-5.4openai/o1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for GPT-5.4 and O1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

GPT-5.4

GPT-5.4 сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Математика, Следование инструкциям) и операционных измерениях (Cheapest input price, Free providers, Provider coverage).

O1

O1 лидирует в категориях benchmark: Знания.

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
7 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

GPT-5.4

57.2

Средний балл

O1

52.3

Агенты

GPT-5.4 впереди на 11.6

GPT-5.457.2
O145.6

Кодинг

GPT-5.4 впереди на 11.8

GPT-5.462.4
O150.6

Reasoning

GPT-5.4 впереди на 5.5

GPT-5.456.2
O150.7

Знания

O1 впереди на 2.6

GPT-5.459.9
O162.5

Математика

GPT-5.4 впереди на 5.0

GPT-5.457.6
O152.6

Многоязычность

Нет данных

GPT-5.4-
O1-

Мультимодальность

GPT-5.4

GPT-5.452.9
O1-

Следование инструкциям

GPT-5.4 впереди на 2.4

GPT-5.453.9
O151.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Ценыverified

Input price

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

$2.50/M

Ранг #150/180 · confidence 4

+$12.50/M

O1

$15.00/M

Ранг #173/180 · confidence 4

Ценыverified

Blended price

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

$5.63/M

Ранг #154/180 · confidence 4

+$20.63/M

O1

$26.25/M

Ранг #173/180 · confidence 4

Ценыverified

Output price

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

$15.00/M

Ранг #155/180 · confidence 4

+$45.00/M

O1

$60.00/M

Ранг #173/180 · confidence 4

Reasoningreported

CritPt

ИсточникGPT-5.4

GPT-5.4

лидер

23.4

Ранг #8/83 · confidence 3 · дата оценки 2026-03-05

+23.1

O1

0.3

Ранг #78/83 · confidence 1 · дата оценки 2024-12-01

Reasoningreported

AA-LCR

ИсточникGPT-5.4

GPT-5.4

лидер

77.7

Ранг #15/100 · confidence 3 · дата оценки 2026-03-05

+14.4

O1

63.3

Ранг #72/100 · confidence 1 · дата оценки 2024-12-01

Reasoningverified

HLE

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

11.3%

Ранг #110/209 · confidence 4

+4.3%

O1

7.0%

Ранг #135/209 · confidence 4

Reasoningverified

GPQA

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

74.8%

Ранг #117/212 · confidence 4

+0.1%

O1

74.7%

Ранг #120/212 · confidence 4

Кодингreported

AA-SciCode

ИсточникGPT-5.4

GPT-5.4

лидер

56.6

Ранг #6/108 · confidence 3 · дата оценки 2026-03-05

+20.8

O1

35.8

Ранг #86/108 · confidence 1 · дата оценки 2024-12-01

Кодингreported

AA Coding Index

ИсточникGPT-5.4

GPT-5.4

лидер

71.0

Ранг #17/70 · confidence 3 · дата оценки 2026-03-05

+37.0

O1

34.0

Ранг #54/70 · confidence 1 · дата оценки 2024-09-12

Кодингverified

SciCode

ИсточникGPT-5.4 (Non-reasoning)

GPT-5.4

лидер

47.1%

Ранг #34/205 · confidence 4

+11.3%

O1

35.8%

Ранг #124/205 · confidence 4

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникGPT-5.4

GPT-5.4

лидер

47.6

Ранг #7/47 · confidence 3 · дата оценки 2026-03-05

+38.3

O1

9.3

Ранг #34/47 · confidence 1 · дата оценки 2024-12-01

Математикаreported

BenchLM Math score

ИсточникGPT-5.4

GPT-5.4

лидер

65.7

Ранг #23/62 · confidence 3 · дата оценки 2026-03-05

+33.1

O1

32.6

Ранг #48/62 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-HLE

ИсточникGPT-5.4

GPT-5.4

лидер

43.7

Ранг #11/108 · confidence 3 · дата оценки 2026-03-05

+36.7

O1

7.0

Ранг #85/108 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-Omniscience Accuracy

ИсточникGPT-5.4

GPT-5.4

лидер

50.8

Ранг #12/101 · confidence 3 · дата оценки 2026-03-05

+16.3

O1

34.5

Ранг #43/101 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникGPT-5.4

GPT-5.4

лидер

91.7

Ранг #13/101 · confidence 3 · дата оценки 2026-03-05

+22.1

O1

69.6

Ранг #54/101 · confidence 1 · дата оценки 2024-12-01

Знанияreported

AA-GPQA Diamond

ИсточникGPT-5.4

GPT-5.4

лидер

92.0

Ранг #17/108 · confidence 3 · дата оценки 2026-03-05

+17.3

O1

74.7

Ранг #84/108 · confidence 1 · дата оценки 2024-12-01

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGPT-5.4

GPT-5.4

лидер

53.1

Ранг #17/111 · confidence 3 · дата оценки 2026-03-05

+35.9

O1

17.2

Ранг #90/111 · confidence 1 · дата оценки 2024-09-12

Знанияreported

BenchLM Knowledge score

ИсточникGPT-5.4

GPT-5.4

лидер

75.3

Ранг #22/69 · confidence 3 · дата оценки 2026-03-05

+11.3

O1

64.0

Ранг #43/69 · confidence 1 · дата оценки 2024-12-01

Следование инструкциямreported

AA-IFBench

ИсточникGPT-5.4

GPT-5.4

лидер

73.9

Ранг #22/84 · confidence 3 · дата оценки 2026-03-05

+3.6

O1

70.3

Ранг #35/84 · confidence 1 · дата оценки 2024-12-01

Агентыreported

τ²-bench results

ИсточникGPT-5.4

GPT-5.4

лидер

98.9

Ранг #2/82 · confidence 3 · дата оценки 2026-03-05

+36.3

O1

62.6

Ранг #61/82 · confidence 1 · дата оценки 2024-12-01

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
GPT-5.4
O1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
GPT-5.4
O1
Sub2API20 tests

GPT-5.4

speed / latency

51 tok/s / 4032ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

QQ Code10 tests

GPT-5.4

speed / latency

55 tok/s / 2903ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

Sub2API10 tests

GPT-5.4

speed / latency

54 tok/s / 1369ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

Sub2API10 tests

GPT-5.4

speed / latency

51 tok/s / 1093ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

微雨API10 tests

GPT-5.4

speed / latency

37 tok/s / 1721ms

input / output

No data

O1

speed / latency

N/A / N/A

input / output

No data

GPT-5.4

gpt-5.4

speed / latency

No data

input / output

$0/M/$0/M

O1

o1-preview

speed / latency

No data

input / output

$11.51/M/$46.03/M

GPT-5.4

gpt-5.4

speed / latency

No data

input / output

$0/request

O1

o1-2024-12-17

speed / latency

No data

input / output

$0/request

GPT-5.4

gpt-5.4

speed / latency

No data

input / output

$0.0027/request

O1

o1

speed / latency

No data

input / output

$1.03/M/$4.11/M

GPT-5.4

gpt-5.4-2026-03-05

speed / latency

No data

input / output

$0.342/M/$2.05/M

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

GPT-5.4

gpt-5.4-2026-03-05

speed / latency

No data

input / output

$0.342/M/$2.05/M

O1

o1-preview-all

speed / latency

No data

input / output

$0.033/request

FAQ

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 4 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.