Data points: 75
Model compare
GPT-4 vs GPT-5.1
Краткий вывод по GPT-4 и GPT-5.1 перед подробной таблицей сравнения.
Key Takeaways
Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.
Вывод
GPT-5.1
GPT-5.1 имеет более высокий взвешенный результат; баллы модели A / B — 30.7 к 69.3.
Глубина данных
75 точек данных
Включает 5 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.
Сигнал выбора
Начать с GPT-5.1
Графики ниже разделяют 15 сильных сигналов по скорости, оценкам и состоянию аудита.
Изменить сравнение
Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.
Выберите другую модель, чтобы открыть новый URL сравнения.
Таблица сравнения
This report only uses LMSpeed data for GPT-4 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
| Model compare | GPT-4 | GPT-5.1 |
|---|---|---|
| Overall leader | Contender | Leading |
| Итоговый взвешенный балл | 30.7 балла | 69.3 балла |
| Лидерство в категориях benchmark | 1 категорий | 2 категорий |
| Операционные преимущества | First-token latency | Cheapest input price, Average speed, Free providers, Provider coverage |
| Контекстное окно | 8.2K токенов | 400K токенов |
| Макс. вывод | 4.1K токенов | 128K токенов |
| Модальности | Вход Текст Выход Текст | Вход ИзображениеТекстФайл Выход Текст |
| Возможности | Текст на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режим | Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning |
В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.
Метаданные модели
Метаданные модели
| Model compare | GPT-4 | GPT-5.1 |
|---|---|---|
| Разработчик | OpenAI | OpenAI |
| Выпущена | май 2023 г. | нояб. 2025 г. |
| Параметры | No data | No data |
| Токенизатор | GPT | GPT |
| Срез знаний | 2021-09-30 | No data |
| OpenRouter ID | openai/gpt-4 | openai/gpt-5.1 |
| Ссылки | No data | No data |
When to choose each model
This report only uses LMSpeed data for GPT-4 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.
GPT-4
GPT-4 сильнее в категориях benchmark (Кодинг) и операционных измерениях (First-token latency).
GPT-5.1
GPT-5.1 сильнее в категориях benchmark (Reasoning, Математика) и операционных измерениях (Cheapest input price, Average speed, Free providers, Provider coverage).
Benchmark score comparison
Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.
Производительность по категориям
Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.
- Покрытие модели A
- 3 / 8
- Покрытие модели B
- 6 / 8
- Общие
- 3 общих категорий
Средний балл
GPT-4
42.4
Средний балл
GPT-5.1
51.9
Агенты
GPT-5.1
Кодинг
GPT-4 впереди на 0.4
Reasoning
GPT-5.1 впереди на 17.1
Знания
GPT-5.1
Математика
GPT-5.1 впереди на 13.3
Многоязычность
Нет данных
Мультимодальность
Нет данных
Следование инструкциям
GPT-5.1
Подробности профессиональных бенчмарков
Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.
Подробности профессиональных бенчмарков
Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.
GPT-4
$30.00/M
Ранг #178/180 · confidence 4
GPT-5.1
лидер$1.25/M
Ранг #119/180 · confidence 4
GPT-4
$37.50/M
Ранг #178/180 · confidence 4
GPT-5.1
лидер$3.44/M
Ранг #135/180 · confidence 4
GPT-4
$60.00/M
Ранг #173/180 · confidence 4
GPT-5.1
лидер$10.00/M
Ранг #138/180 · confidence 4
GPT-4
34.9%
Ранг #205/212 · confidence 4
GPT-5.1
лидер87.3%
Ранг #48/212 · confidence 4
GPT-4
56.2%
Ранг #121/129 · confidence 4
GPT-5.1
лидер80.1%
Ранг #62/129 · confidence 4
API audit comparison
Latest completed audits from shared providers, with four safety and integrity score groups plus report links.
API audit comparison
Latest completed audits from shared providers, with four safety and integrity score groups plus report links.
| Provider | GPT-4 | GPT-5.1 |
|---|---|---|
| No completed audits are available from shared providers yet. | ||
Provider examples
Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.
Provider examples
Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.
| Provider | GPT-4 | GPT-5.1 |
|---|---|---|
BUZZ10 tests | GPT-4 speed / latency N/A / N/A input / output No data | GPT-5.1 speed / latency 137 tok/s / 3299ms input / output No data |
N1N5 tests | GPT-4 speed / latency N/A / N/A input / output No data | GPT-5.1 speed / latency 96 tok/s / 1862ms input / output No data |
42公益站0 tests | GPT-4 speed / latency N/A / N/A input / output No data | GPT-5.1 speed / latency N/A / N/A input / output No data |
AASS API0 tests | GPT-4 speed / latency N/A / N/A input / output No data | GPT-5.1 speed / latency N/A / N/A input / output No data |
AI API0 tests | GPT-4 speed / latency N/A / N/A input / output No data | GPT-5.1 speed / latency N/A / N/A input / output No data |
GPT-4 gpt-4 speed / latency No data input / output $0/request | GPT-5.1 gpt-5.1-chat-latest speed / latency No data input / output $0/request | |
GPT-4 gpt-4-all speed / latency No data input / output $0.021/request | GPT-5.1 gpt-5.1 speed / latency No data input / output $0.0027/request | |
GPT-4 gpt-4-all speed / latency No data input / output $0.014/request | GPT-5.1 gpt-5.1 speed / latency No data input / output $0.0068/request | |
GPT-4 gpt-4-all speed / latency No data input / output $0.011/request | GPT-5.1 gpt-5.1-all speed / latency No data input / output $0.137/M/$1.10/M | |
GPT-4 gpt-4-all speed / latency No data input / output $0.011/request | GPT-5.1 gpt-5.1 speed / latency No data input / output $0.137/M/$1.10/M |
FAQ
Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.
- Why is this comparison indexable?
- It has 6 verifiable comparison points, and both models have pricing or benchmark data.
- Are missing metrics invented?
- No. Metrics without LMSpeed data are omitted from this report.
