Back to models

Model compare

GPT-4o vs GPT-5.1

Краткий вывод по GPT-4o и GPT-5.1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.1

GPT-5.1 имеет более высокий взвешенный результат; баллы модели A / B — 4 к 96.

Глубина данных

105 точек данных

Включает 20 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.1

Графики ниже разделяют 30 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for GPT-4o and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
GPT-4o
GPT-5.1
Overall leaderContenderLeading
Итоговый взвешенный балл4.0 балла96.0 балла
Лидерство в категориях benchmark0 категорий6 категорий
Операционные преимуществаCheapest input priceAverage speed, First-token latency, Free providers, Provider coverage
Контекстное окно128K токенов400K токенов
Макс. вывод16.4K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ИзображениеТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимВеб-поиск
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
GPT-4o
GPT-5.1
РазработчикOpenAIOpenAI
Выпущенанояб. 2024 г.нояб. 2025 г.
ПараметрыNo dataNo data
ТокенизаторGPTGPT
Срез знаний2023-10-31No data
OpenRouter IDopenai/gpt-4oopenai/gpt-5.1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for GPT-4o and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

GPT-4o

Операционные преимущества GPT-4o: Cheapest input price.

GPT-5.1

GPT-5.1 сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Знания, Математика) и операционных измерениях (Average speed, First-token latency, Free providers, Provider coverage).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
6 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

GPT-4o

43

Средний балл

GPT-5.1

51.9

Агенты

GPT-5.1 впереди на 8.7

GPT-4o39
GPT-5.147.7

Кодинг

GPT-5.1 впереди на 3.1

GPT-4o46
GPT-5.149.1

Reasoning

GPT-5.1 впереди на 14.1

GPT-4o39.9
GPT-5.154

Знания

GPT-5.1 впереди на 4.0

GPT-4o49
GPT-5.153

Математика

GPT-5.1 впереди на 11.8

GPT-4o42.2
GPT-5.154

Многоязычность

Нет данных

GPT-4o-
GPT-5.1-

Мультимодальность

Нет данных

GPT-4o-
GPT-5.1-

Следование инструкциям

GPT-5.1 впереди на 11.9

GPT-4o41.6
GPT-5.153.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникGPT-4o

GPT-4o

43.0

Ранг #91/100 · confidence 1 · дата оценки 2024-05-13

+13.0

GPT-5.1

лидер

56.0

Ранг #50/100 · confidence 1 · дата оценки 2025-11-13

Ценыverified

Input price

ИсточникGPT-4o (Nov '24)

GPT-4o

$2.50/M

Ранг #150/180 · confidence 4

+$1.25/M

GPT-5.1

лидер

$1.25/M

Ранг #119/180 · confidence 4

Ценыverified

Blended price

ИсточникGPT-4o (Nov '24)

GPT-4o

$4.38/M

Ранг #145/180 · confidence 4

+$0.937/M

GPT-5.1

лидер

$3.44/M

Ранг #135/180 · confidence 4

Ценыverified

Output price

ИсточникGPT-4o (Nov '24)

GPT-4o

$10.00/M

Ранг #138/180 · confidence 4

$0.0000/M

GPT-5.1

$10.00/M

Ранг #138/180 · confidence 4

Reasoningverified

GPQA

ИсточникGPT-4o (Nov '24)

GPT-4o

54.3%

Ранг #178/212 · confidence 4

+33.0%

GPT-5.1

лидер

87.3%

Ранг #48/212 · confidence 4

Reasoningverified

HLE

ИсточникGPT-4o (Nov '24)

GPT-4o

2.4%

Ранг #207/209 · confidence 4

+26.1%

GPT-5.1

лидер

28.5%

Ранг #56/209 · confidence 4

Reasoningverified

MMLU-Pro

ИсточникGPT-4o (Nov '24)

GPT-4o

74.8%

Ранг #90/129 · confidence 4

+5.3%

GPT-5.1

лидер

80.1%

Ранг #62/129 · confidence 4

Кодингverified

LiveCodeBench

ИсточникGPT-4o (Nov '24)

GPT-4o

30.9%

Ранг #88/115 · confidence 4

+55.9%

GPT-5.1

лидер

86.8%

Ранг #4/115 · confidence 4

Кодингreported

AA-SciCode

ИсточникGPT-4o

GPT-4o

33.3

Ранг #91/108 · confidence 1 · дата оценки 2024-05-13

+10.0

GPT-5.1

лидер

43.3

Ранг #55/108 · confidence 1 · дата оценки 2025-11-13

Кодингverified

SciCode

ИсточникGPT-4o (Nov '24)

GPT-4o

33.3%

Ранг #138/205 · confidence 4

+10.0%

GPT-5.1

лидер

43.3%

Ранг #56/205 · confidence 4

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникGPT-4o

GPT-4o

0.3

Ранг #47/47 · confidence 1 · дата оценки 2024-05-13

+30.7

GPT-5.1

лидер

31.0

Ранг #19/47 · confidence 1 · дата оценки 2025-11-13

Математикаreported

BenchLM Math score

ИсточникGPT-4o

GPT-4o

25.2

Ранг #60/62 · confidence 1 · дата оценки 2024-05-13

+24.5

GPT-5.1

лидер

49.7

Ранг #36/62 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Accuracy

ИсточникGPT-4o

GPT-4o

19.9

Ранг #86/101 · confidence 1 · дата оценки 2024-05-13

+17.8

GPT-5.1

лидер

37.7

Ранг #39/101 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-GPQA Diamond

ИсточникGPT-4o

GPT-4o

54.3

Ранг #102/108 · confidence 1 · дата оценки 2024-05-13

+33.0

GPT-5.1

лидер

87.3

Ранг #44/108 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-HLE

ИсточникGPT-4o

GPT-4o

2.4

Ранг #108/108 · confidence 1 · дата оценки 2024-05-13

+26.1

GPT-5.1

лидер

28.5

Ранг #47/108 · confidence 1 · дата оценки 2025-11-13

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGPT-4o

GPT-4o

11.1

Ранг #101/111 · confidence 1 · дата оценки 2024-05-13

+26.4

GPT-5.1

лидер

37.5

Ранг #52/111 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникGPT-4o

GPT-4o

37.9

Ранг #86/101 · confidence 1 · дата оценки 2024-05-13

+14.0

GPT-5.1

лидер

51.9

Ранг #72/101 · confidence 1 · дата оценки 2025-11-13

Мультимодальностьreported

Design Arena Website

ИсточникGPT-4o

GPT-4o

842.0

Ранг #74/75 · confidence 1 · дата оценки 2024-05-13

+356.0

GPT-5.1

лидер

1198.0

Ранг #48/75 · confidence 1 · дата оценки 2025-11-13

Следование инструкциямreported

AA-IFBench

ИсточникGPT-4o

GPT-4o

34.3

Ранг #80/84 · confidence 1 · дата оценки 2024-05-13

+38.6

GPT-5.1

лидер

72.9

Ранг #28/84 · confidence 1 · дата оценки 2025-11-13

Агентыreported

τ²-bench results

ИсточникGPT-4o

GPT-4o

25.1

Ранг #73/82 · confidence 1 · дата оценки 2024-05-13

+56.8

GPT-5.1

лидер

81.9

Ранг #53/82 · confidence 1 · дата оценки 2025-11-13

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
GPT-4o
GPT-5.1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
GPT-4o
GPT-5.1
速创API20 tests

GPT-4o

speed / latency

88 tok/s / 1593ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

BUZZ10 tests

GPT-4o

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

137 tok/s / 3299ms

input / output

No data

CatClaw API10 tests

GPT-4o

speed / latency

57 tok/s / 3381ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

KFCV505 tests

GPT-4o

speed / latency

48 tok/s / 13138ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

N1N5 tests

GPT-4o

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

96 tok/s / 1862ms

input / output

No data

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0/request

GPT-5.1

gpt-5.1-chat-latest

speed / latency

No data

input / output

$0/request

GPT-4o

gpt-4o

speed / latency

No data

input / output

$0.050/request

GPT-5.1

gpt-5-1

speed / latency

No data

input / output

$0/request

GPT-4o

gpt-4o-2024-11-20

speed / latency

No data

input / output

$0.342/M/$1.37/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0027/request

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0.0066/request

GPT-5.1

gpt-5.1-all

speed / latency

No data

input / output

$0.137/M/$1.10/M

GPT-4o

gpt-4o-all

speed / latency

No data

input / output

$0.0066/request

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.137/M/$1.10/M

FAQ

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.