Back to models

Model compare

DeepSeek R1 vs GPT-5.1

Краткий вывод по DeepSeek R1 и GPT-5.1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.1

GPT-5.1 имеет более высокий взвешенный результат; баллы модели A / B — 30.7 к 69.3.

Глубина данных

100 точек данных

Включает 17 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.1

Графики ниже разделяют 27 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for DeepSeek R1 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
DeepSeek R1
GPT-5.1
Overall leaderContenderLeading
Итоговый взвешенный балл30.7 балла69.3 балла
Лидерство в категориях benchmark2 категорий4 категорий
Операционные преимуществаCheapest input priceAverage speed, First-token latency, Free providers, Provider coverage
Контекстное окно64K токенов400K токенов
Макс. вывод16K токенов128K токенов
Модальности

Вход

Текст

Выход

Текст

Вход

ИзображениеТекстФайл

Выход

Текст
Возможности
Текст на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
DeepSeek R1
GPT-5.1
РазработчикDeepSeekOpenAI
Выпущенамай 2025 г.нояб. 2025 г.
ПараметрыNo dataNo data
ТокенизаторDeepSeekGPT
Срез знаний2024-07-31No data
OpenRouter IDdeepseek/deepseek-r1openai/gpt-5.1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for DeepSeek R1 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

DeepSeek R1

DeepSeek R1 сильнее в категориях benchmark (Кодинг, Математика) и операционных измерениях (Cheapest input price).

GPT-5.1

GPT-5.1 сильнее в категориях benchmark (Агенты, Reasoning, Знания, Следование инструкциям) и операционных измерениях (Average speed, First-token latency, Free providers, Provider coverage).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
6 / 8
Покрытие модели B
7 / 8
Общие
6 общих категорий

Средний балл

DeepSeek R1

47.6

Средний балл

GPT-5.1

51.2

Агенты

GPT-5.1 впереди на 6.6

DeepSeek R141
GPT-5.147.6

Кодинг

DeepSeek R1 впереди на 0.1

DeepSeek R149.6
GPT-5.149.5

Reasoning

GPT-5.1 впереди на 3.9

DeepSeek R149.9
GPT-5.153.8

Знания

GPT-5.1 впереди на 7.1

DeepSeek R144.6
GPT-5.151.7

Математика

DeepSeek R1 впереди на 3.6

DeepSeek R157
GPT-5.153.4

Многоязычность

Нет данных

DeepSeek R1-
GPT-5.1-

Мультимодальность

GPT-5.1

DeepSeek R1-
GPT-5.148.8

Следование инструкциям

GPT-5.1 впереди на 10.2

DeepSeek R143.3
GPT-5.153.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Ценыverified

Output price

DeepSeek R1

лидер

$3.00/M

Ранг #98/185 · confidence 4

+$7.00/M

GPT-5.1

$10.00/M

Ранг #141/185 · confidence 4

Ценыverified

Blended price

DeepSeek R1

лидер

$1.76/M

Ранг #116/185 · confidence 4

+$1.68/M

GPT-5.1

$3.44/M

Ранг #138/185 · confidence 4

Ценыverified

Input price

DeepSeek R1

$1.35/M

Ранг #134/185 · confidence 4

+$0.100/M

GPT-5.1

лидер

$1.25/M

Ранг #122/185 · confidence 4

Reasoningreported

AA-LCR

ИсточникDeepSeek-R1

DeepSeek R1

56.7

Ранг #81/106 · confidence 1 · дата оценки 2025-01-20

+20.0

GPT-5.1

лидер

76.7

Ранг #24/106 · confidence 3 · дата оценки 2025-11-13

Reasoningverified

MMLU-Pro

ИсточникDeepSeek R1 (Jan '25)

DeepSeek R1

лидер

84.4%

Ранг #32/129 · confidence 4

+4.3%

GPT-5.1

80.1%

Ранг #62/129 · confidence 4

Reasoningreported

CritPt

ИсточникDeepSeek-R1

DeepSeek R1

1.4

Ранг #66/88 · confidence 1 · дата оценки 2025-01-20

+3.5

GPT-5.1

лидер

4.9

Ранг #48/88 · confidence 3 · дата оценки 2025-11-13

Reasoningverified

GPQA

DeepSeek R1

81.3%

Ранг #92/217 · confidence 4

+6.0%

GPT-5.1

лидер

87.3%

Ранг #52/217 · confidence 4

Reasoningverified

HLE

DeepSeek R1

15.8%

Ранг #98/214 · confidence 4

+12.7%

GPT-5.1

лидер

28.5%

Ранг #60/214 · confidence 4

Кодингverified

LiveCodeBench

DeepSeek R1

77.0%

Ранг #22/115 · confidence 4

+9.8%

GPT-5.1

лидер

86.8%

Ранг #4/115 · confidence 4

Кодингreported

AA-SciCode

ИсточникDeepSeek-R1

DeepSeek R1

40.3

Ранг #71/113 · confidence 1 · дата оценки 2025-01-20

+3.0

GPT-5.1

лидер

43.3

Ранг #60/113 · confidence 3 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникDeepSeek-R1

DeepSeek R1

лидер

83.4

Ранг #32/106 · confidence 1 · дата оценки 2025-01-20

+31.5

GPT-5.1

51.9

Ранг #74/106 · confidence 3 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Accuracy

ИсточникDeepSeek-R1

DeepSeek R1

30.5

Ранг #55/106 · confidence 1 · дата оценки 2025-01-20

+7.2

GPT-5.1

лидер

37.7

Ранг #43/106 · confidence 3 · дата оценки 2025-11-13

Знанияreported

AA-GPQA Diamond

ИсточникDeepSeek-R1

DeepSeek R1

81.3

Ранг #74/113 · confidence 1 · дата оценки 2025-01-20

+6.0

GPT-5.1

лидер

87.3

Ранг #49/113 · confidence 3 · дата оценки 2025-11-13

Знанияreported

AA-HLE

ИсточникDeepSeek-R1

DeepSeek R1

15.8

Ранг #77/114 · confidence 1 · дата оценки 2025-01-20

+12.7

GPT-5.1

лидер

28.5

Ранг #53/114 · confidence 3 · дата оценки 2025-11-13

Знанияreported

Artificial Analysis Intelligence Index

ИсточникDeepSeek-R1

DeepSeek R1

20.4

Ранг #90/117 · confidence 1 · дата оценки 2025-01-20

+17.1

GPT-5.1

лидер

37.5

Ранг #58/117 · confidence 3 · дата оценки 2025-11-13

Следование инструкциямreported

AA-IFBench

ИсточникDeepSeek-R1

DeepSeek R1

39.6

Ранг #69/84 · confidence 1 · дата оценки 2025-01-20

+33.3

GPT-5.1

лидер

72.9

Ранг #27/84 · confidence 3 · дата оценки 2025-11-13

Агентыreported

τ²-bench results

ИсточникDeepSeek-R1

DeepSeek R1

36.5

Ранг #71/82 · confidence 1 · дата оценки 2025-01-20

+45.4

GPT-5.1

лидер

81.9

Ранг #53/82 · confidence 3 · дата оценки 2025-11-13

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
DeepSeek R1
GPT-5.1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
DeepSeek R1
GPT-5.1
ChatGTP30 tests

DeepSeek R1

speed / latency

47 tok/s / 15233ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

OpenRouter24 tests

DeepSeek R1

speed / latency

43 tok/s / 16905ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

ocool AI13 tests

DeepSeek R1

speed / latency

104 tok/s / 2242ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

Gpt API10 tests

DeepSeek R1

speed / latency

38 tok/s / 2259ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

AASS API5 tests

DeepSeek R1

speed / latency

34 tok/s / 938ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

DeepSeek R1

deepseek-r1

speed / latency

No data

input / output

$0/M/$0/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.086/M/$0.685/M

DeepSeek R1

deepseek-r1

speed / latency

No data

input / output

$0/request

GPT-5.1

gpt-5.1-chat-latest

speed / latency

No data

input / output

$0/request

DeepSeek R1

deepseek-r1

speed / latency

No data

input / output

$0.164/M/$0.658/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0027/request

DeepSeek R1

次DeepSeek-R1

speed / latency

No data

input / output

$0.0034/request

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.205/M/$1.64/M

DeepSeek R1

deepseek-r1

speed / latency

No data

input / output

$0.110/M/$0.438/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0068/request

FAQ

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.