Back to models

Model compare

Claude Haiku 4.5 vs GPT-5.1

Краткий вывод по Claude Haiku 4.5 и GPT-5.1 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.1

GPT-5.1 имеет более высокий взвешенный результат; баллы модели A / B — 16 к 84.

Глубина данных

90 точек данных

Включает 13 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.1

Графики ниже разделяют 23 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for Claude Haiku 4.5 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
Claude Haiku 4.5
GPT-5.1
Overall leaderContenderLeading
Итоговый взвешенный балл16.0 балла84.0 балла
Лидерство в категориях benchmark0 категорий4 категорий
Операционные преимуществаCheapest input price, First-token latency, Free providers, Provider coverageAverage speed
Контекстное окно200K токенов400K токенов
Макс. вывод64K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ИзображениеТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
Claude Haiku 4.5
GPT-5.1
РазработчикAnthropicOpenAI
Выпущенаокт. 2025 г.нояб. 2025 г.
ПараметрыNo dataNo data
ТокенизаторClaudeGPT
Срез знанийNo dataNo data
OpenRouter IDanthropic/claude-haiku-4.5openai/gpt-5.1
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for Claude Haiku 4.5 and GPT-5.1: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Claude Haiku 4.5

Операционные преимущества Claude Haiku 4.5: Cheapest input price, First-token latency, Free providers, Provider coverage.

GPT-5.1

GPT-5.1 сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Математика) и операционных измерениях (Average speed).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
4 / 8
Покрытие модели B
6 / 8
Общие
4 общих категорий

Средний балл

Claude Haiku 4.5

45.6

Средний балл

GPT-5.1

51.9

Агенты

GPT-5.1 впереди на 5.2

Claude Haiku 4.542.5
GPT-5.147.7

Кодинг

GPT-5.1 впереди на 2.6

Claude Haiku 4.546.5
GPT-5.149.1

Reasoning

GPT-5.1 впереди на 6.5

Claude Haiku 4.547.5
GPT-5.154

Знания

GPT-5.1

Claude Haiku 4.5-
GPT-5.153

Математика

GPT-5.1 впереди на 8.3

Claude Haiku 4.545.7
GPT-5.154

Многоязычность

Нет данных

Claude Haiku 4.5-
GPT-5.1-

Мультимодальность

Нет данных

Claude Haiku 4.5-
GPT-5.1-

Следование инструкциям

GPT-5.1

Claude Haiku 4.5-
GPT-5.153.5

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникClaude Haiku 4.5

Claude Haiku 4.5

55.0

Ранг #55/100 · confidence 1 · дата оценки 2025-10-15

+1.0

GPT-5.1

лидер

56.0

Ранг #50/100 · confidence 1 · дата оценки 2025-11-13

Ценыverified

Input price

Claude Haiku 4.5

лидер

$1.00/M

Ранг #110/180 · confidence 4

+$0.250/M

GPT-5.1

$1.25/M

Ранг #119/180 · confidence 4

Ценыverified

Blended price

Claude Haiku 4.5

лидер

$2.00/M

Ранг #118/180 · confidence 4

+$1.44/M

GPT-5.1

$3.44/M

Ранг #135/180 · confidence 4

Ценыverified

Output price

Claude Haiku 4.5

лидер

$5.00/M

Ранг #123/180 · confidence 4

+$5.00/M

GPT-5.1

$10.00/M

Ранг #138/180 · confidence 4

Reasoningverified

GPQA

Claude Haiku 4.5

64.6%

Ранг #153/212 · confidence 4

+22.7%

GPT-5.1

лидер

87.3%

Ранг #48/212 · confidence 4

Reasoningverified

HLE

Claude Haiku 4.5

4.2%

Ранг #170/209 · confidence 4

+24.3%

GPT-5.1

лидер

28.5%

Ранг #56/209 · confidence 4

Reasoningverified

MMLU-Pro

Claude Haiku 4.5

80.0%

Ранг #63/129 · confidence 4

+0.1%

GPT-5.1

лидер

80.1%

Ранг #62/129 · confidence 4

Кодингverified

LiveCodeBench

Claude Haiku 4.5

51.1%

Ранг #59/115 · confidence 4

+35.7%

GPT-5.1

лидер

86.8%

Ранг #4/115 · confidence 4

Кодингverified

SciCode

Claude Haiku 4.5

34.4%

Ранг #133/205 · confidence 4

+8.9%

GPT-5.1

лидер

43.3%

Ранг #56/205 · confidence 4

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникClaude Haiku 4.5

Claude Haiku 4.5

2.1

Ранг #32/35 · confidence 1 · дата оценки 2025-10-15

+10.4

GPT-5.1

лидер

12.5

Ранг #16/35 · confidence 1 · дата оценки 2025-11-13

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникClaude Haiku 4.5

Claude Haiku 4.5

5.9

Ранг #36/47 · confidence 1 · дата оценки 2025-10-15

+25.1

GPT-5.1

лидер

31.0

Ранг #19/47 · confidence 1 · дата оценки 2025-11-13

Математикаreported

BenchLM Math score

ИсточникClaude Haiku 4.5

Claude Haiku 4.5

29.0

Ранг #49/62 · confidence 1 · дата оценки 2025-10-15

+20.7

GPT-5.1

лидер

49.7

Ранг #36/62 · confidence 1 · дата оценки 2025-11-13

Мультимодальностьreported

Design Arena Website

ИсточникClaude Haiku 4.5

Claude Haiku 4.5

1133.0

Ранг #62/75 · confidence 1 · дата оценки 2025-10-15

+65.0

GPT-5.1

лидер

1198.0

Ранг #48/75 · confidence 1 · дата оценки 2025-11-13

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
Claude Haiku 4.5
GPT-5.1
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
Claude Haiku 4.5
GPT-5.1
N1N20 tests

Claude Haiku 4.5

speed / latency

112 tok/s / 1733ms

input / output

No data

GPT-5.1

speed / latency

96 tok/s / 1862ms

input / output

No data

BUZZ10 tests

Claude Haiku 4.5

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

137 tok/s / 3299ms

input / output

No data

发现AI10 tests

Claude Haiku 4.5

speed / latency

68 tok/s / 4647ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

Claude Haiku 4.5

speed / latency

21 tok/s / 1170ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

Claude Haiku 4.5

speed / latency

109 tok/s / 2221ms

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

Claude Haiku 4.5

claude-haiku-4-5-20251001

speed / latency

No data

input / output

$0/request

GPT-5.1

gpt-5.1-chat-latest

speed / latency

No data

input / output

$0/request

Claude Haiku 4.5

claude-haiku-4-5-20251001

speed / latency

No data

input / output

$0.068/M/$0.342/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0027/request

Claude Haiku 4.5

claude-haiku-4-5-20251001

speed / latency

No data

input / output

$0.0029/M/$0.014/M

GPT-5.1

gpt-5.1-high

speed / latency

No data

input / output

$0.179/M/$1.43/M

Claude Haiku 4.5

claude-haiku-4-5-20251001

speed / latency

No data

input / output

$0.034/M/$0.171/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0068/request

Claude Haiku 4.5

claude-haiku-4-5-c

speed / latency

No data

input / output

$0.0068/request

GPT-5.1

gpt-5.1-chat-2025-11-13

speed / latency

No data

input / output

$0.137/M/$1.10/M

FAQ

Взвешенный результат: GPT-5.1. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.