Back to models

Model compare

Claude Sonnet 4.6 vs GPT-5.1

Краткий вывод по Claude Sonnet 4.6 и GPT-5.1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: Claude Sonnet 4.6. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

Claude Sonnet 4.6

Claude Sonnet 4.6 имеет более высокий взвешенный результат; баллы модели A / B — 52 к 48.

Глубина данных

114 точек данных

Включает 25 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с Claude Sonnet 4.6

Графики ниже разделяют 35 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for Claude Sonnet 4.6 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
Claude Sonnet 4.6
GPT-5.1
Overall leaderLeadingContender
Итоговый взвешенный балл52.0 балла48.0 балла
Лидерство в категориях benchmark3 категорий3 категорий
Операционные преимуществаCheapest input price, Free providers, Provider coverageAverage speed, First-token latency
Контекстное окно1M токенов400K токенов
Макс. вывод128K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ИзображениеТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
Claude Sonnet 4.6
GPT-5.1
РазработчикAnthropicOpenAI
Выпущенафевр. 2026 г.нояб. 2025 г.
ПараметрыNo dataNo data
ТокенизаторClaudeGPT
Срез знанийNo dataNo data
OpenRouter IDanthropic/claude-sonnet-4.6openai/gpt-5.1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for Claude Sonnet 4.6 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Claude Sonnet 4.6

Claude Sonnet 4.6 сильнее в категориях benchmark (Агенты, Кодинг, Знания) и операционных измерениях (Cheapest input price, Free providers, Provider coverage).

GPT-5.1

GPT-5.1 сильнее в категориях benchmark (Reasoning, Математика, Следование инструкциям) и операционных измерениях (Average speed, First-token latency).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
7 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

Claude Sonnet 4.6

53.1

Средний балл

GPT-5.1

51.9

Агенты

Claude Sonnet 4.6 впереди на 5.0

Claude Sonnet 4.652.7
GPT-5.147.7

Кодинг

Claude Sonnet 4.6 впереди на 6.8

Claude Sonnet 4.655.9
GPT-5.149.1

Reasoning

GPT-5.1 впереди на 4.2

Claude Sonnet 4.649.8
GPT-5.154

Знания

Claude Sonnet 4.6 впереди на 17.6

Claude Sonnet 4.670.6
GPT-5.153

Математика

GPT-5.1 впереди на 0.8

Claude Sonnet 4.653.2
GPT-5.154

Многоязычность

Нет данных

Claude Sonnet 4.6-
GPT-5.1-

Мультимодальность

Claude Sonnet 4.6

Claude Sonnet 4.645.7
GPT-5.1-

Следование инструкциям

GPT-5.1 впереди на 9.8

Claude Sonnet 4.643.7
GPT-5.153.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

59.0

Ранг #39/100 · confidence 3 · дата оценки 2026-02-01

+3.0

GPT-5.1

56.0

Ранг #50/100 · confidence 1 · дата оценки 2025-11-13

Ценыverified

Input price

Claude Sonnet 4.6

$3.00/M

Ранг #155/180 · confidence 4

+$1.75/M

GPT-5.1

лидер

$1.25/M

Ранг #119/180 · confidence 4

Ценыverified

Blended price

Claude Sonnet 4.6

$6.00/M

Ранг #155/180 · confidence 4

+$2.56/M

GPT-5.1

лидер

$3.44/M

Ранг #135/180 · confidence 4

Ценыverified

Output price

Claude Sonnet 4.6

$15.00/M

Ранг #155/180 · confidence 4

+$5.00/M

GPT-5.1

лидер

$10.00/M

Ранг #138/180 · confidence 4

Reasoningreported

AA-LCR

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

62.3

Ранг #73/100 · confidence 3 · дата оценки 2026-02-01

+14.4

GPT-5.1

лидер

76.7

Ранг #19/100 · confidence 1 · дата оценки 2025-11-13

Reasoningreported

CritPt

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

0.9

Ранг #70/83 · confidence 3 · дата оценки 2026-02-01

+4.0

GPT-5.1

лидер

4.9

Ранг #43/83 · confidence 1 · дата оценки 2025-11-13

Reasoningverified

HLE

Claude Sonnet 4.6

лидер

33.6%

Ранг #44/209 · confidence 4

+5.1%

GPT-5.1

28.5%

Ранг #56/209 · confidence 4

Reasoningverified

GPQA

Claude Sonnet 4.6

лидер

87.5%

Ранг #46/212 · confidence 4

+0.2%

GPT-5.1

87.3%

Ранг #48/212 · confidence 4

Reasoningreported

MMLU-Pro

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

79.2%

Ранг #69/129 · confidence 3 · дата оценки 2026-02-01

+0.9%

GPT-5.1

лидер

80.1%

Ранг #62/129 · confidence 4

Кодингreported

Vibe Code Bench

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

51.5

Ранг #7/33 · confidence 3 · дата оценки 2026-02-01

+26.9

GPT-5.1

24.6

Ранг #18/33 · confidence 1 · дата оценки 2025-11-13

Кодингverified

SciCode

Claude Sonnet 4.6

лидер

46.8%

Ранг #39/205 · confidence 4

+3.5%

GPT-5.1

43.3%

Ранг #56/205 · confidence 4

Кодингreported

AA-SciCode

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

46.9

Ранг #42/108 · confidence 3 · дата оценки 2026-02-01

+3.6

GPT-5.1

43.3

Ранг #55/108 · confidence 1 · дата оценки 2025-11-13

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

8.3

Ранг #19/35 · confidence 3 · дата оценки 2026-02-01

+4.2

GPT-5.1

лидер

12.5

Ранг #16/35 · confidence 1 · дата оценки 2025-11-13

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

32.4

Ранг #18/47 · confidence 3 · дата оценки 2026-02-01

+1.4

GPT-5.1

31.0

Ранг #19/47 · confidence 1 · дата оценки 2025-11-13

Математикаreported

BenchLM Math score

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

49.4

Ранг #37/62 · confidence 3 · дата оценки 2026-02-01

+0.3

GPT-5.1

лидер

49.7

Ранг #36/62 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Accuracy

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

38.6

Ранг #36/101 · confidence 3 · дата оценки 2026-02-01

+0.9

GPT-5.1

37.7

Ранг #39/101 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-GPQA Diamond

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

79.9

Ранг #74/108 · confidence 3 · дата оценки 2026-02-01

+7.4

GPT-5.1

лидер

87.3

Ранг #44/108 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-HLE

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

13.3

Ранг #76/108 · confidence 3 · дата оценки 2026-02-01

+15.2

GPT-5.1

лидер

28.5

Ранг #47/108 · confidence 1 · дата оценки 2025-11-13

Знанияreported

Artificial Analysis Intelligence Index

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

36.8

Ранг #54/111 · confidence 3 · дата оценки 2026-02-01

+0.7

GPT-5.1

лидер

37.5

Ранг #52/111 · confidence 1 · дата оценки 2025-11-13

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

68.5

Ранг #56/101 · confidence 3 · дата оценки 2026-02-01

+16.6

GPT-5.1

51.9

Ранг #72/101 · confidence 1 · дата оценки 2025-11-13

Мультимодальностьreported

Design Arena Website

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

1305.0

Ранг #12/75 · confidence 3 · дата оценки 2026-02-01

+107.0

GPT-5.1

1198.0

Ранг #48/75 · confidence 1 · дата оценки 2025-11-13

Мультимодальностьreported

AA-MMMU-Pro

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

70.6

Ранг #47/65 · confidence 3 · дата оценки 2026-02-01

+4.9

GPT-5.1

лидер

75.5

Ранг #28/65 · confidence 1 · дата оценки 2025-11-13

Следование инструкциямreported

AA-IFBench

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

41.2

Ранг #67/84 · confidence 3 · дата оценки 2026-02-01

+31.7

GPT-5.1

лидер

72.9

Ранг #28/84 · confidence 1 · дата оценки 2025-11-13

Агентыreported

Gert Labs

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

лидер

62.9

Ранг #8/49 · confidence 3 · дата оценки 2026-02-01

+21.7

GPT-5.1

41.2

Ранг #34/49 · confidence 1 · дата оценки 2025-11-13

Агентыreported

τ²-bench results

ИсточникClaude Sonnet 4.6

Claude Sonnet 4.6

79.5

Ранг #55/82 · confidence 3 · дата оценки 2026-02-01

+2.4

GPT-5.1

лидер

81.9

Ранг #53/82 · confidence 1 · дата оценки 2025-11-13

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
Claude Sonnet 4.6
GPT-5.1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
Claude Sonnet 4.6
GPT-5.1
天宫造物25 tests

Claude Sonnet 4.6

speed / latency

40 tok/s / 3145ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

巨量API14 tests

Claude Sonnet 4.6

speed / latency

39 tok/s / 5723ms

input / output

No data

GPT-5.1

speed / latency

139 tok/s / 1654ms

input / output

No data

BUZZ10 tests

Claude Sonnet 4.6

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

137 tok/s / 3299ms

input / output

No data

ModelPool10 tests

Claude Sonnet 4.6

speed / latency

41 tok/s / 3714ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

N1N10 tests

Claude Sonnet 4.6

speed / latency

55 tok/s / 2094ms

input / output

No data

GPT-5.1

speed / latency

96 tok/s / 1862ms

input / output

No data

Claude Sonnet 4.6

claude-sonnet-4-6

speed / latency

No data

input / output

$0/request

GPT-5.1

gpt-5.1-chat-latest

speed / latency

No data

input / output

$0/request

Claude Sonnet 4.6

claude-sonnet-4-6

speed / latency

No data

input / output

$0.050/request

GPT-5.1

gpt-5-1

speed / latency

No data

input / output

$0/request

Claude Sonnet 4.6

claude-sonnet-4-6

speed / latency

No data

input / output

$0.205/M/$1.03/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0027/request

Claude Sonnet 4.6

claude-sonnet-4-6

speed / latency

No data

input / output

$0.010/request

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0068/request

Claude Sonnet 4.6

claude-sonnet-4-6-c

speed / latency

No data

input / output

$0.0082/request

GPT-5.1

gpt-5.1-chat-2025-11-13

speed / latency

No data

input / output

$0.137/M/$1.10/M

FAQ

Взвешенный результат: Claude Sonnet 4.6. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.