Вернуться к моделям

Сравнение моделей

Claude Opus 4.6 vs GPT-5.4

Краткий вывод по Claude Opus 4.6 и GPT-5.4 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.4

GPT-5.4 имеет более высокий взвешенный результат; баллы модели A / B — 4 к 96.

Глубина данных

164 точек данных

Включает 50 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.4

Графики ниже разделяют 60 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.4: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Сравнение моделей
Claude Opus 4.6
GPT-5.4
Общий лидерСоперникЛидирует
Итоговый взвешенный балл4.0 балла96.0 балла
Лидерство в категориях benchmark0 категорий7 категорий
Операционные преимуществаМинимальная цена вводаСредняя скорость, Задержка первого токена, Бесплатные поставщики, Набор поставщиков
Контекстное окно1M токенов1.1M токенов
Макс. вывод128K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстИзображениеФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Сравнение моделей
Claude Opus 4.6
GPT-5.4
РазработчикAnthropicOpenAI
Выпущенафевр. 2026 г.март 2026 г.
ПараметрыНет данныхНет данных
ТокенизаторClaudeGPT
Срез знанийНет данныхНет данных
OpenRouter IDanthropic/claude-opus-4.6openai/gpt-5.4
СсылкиНет данныхНет данных

Когда выбирать каждую модель

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.4: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Claude Opus 4.6

Операционные преимущества Claude Opus 4.6: Минимальная цена ввода.

GPT-5.4

GPT-5.4 сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Знания, Математика) и операционных измерениях (Средняя скорость, Задержка первого токена, Бесплатные поставщики, Набор поставщиков).

Сравнение результатов тестов

Независимые тесты, собранные LMSpeed. Показаны только показатели, доступные для обеих моделей.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
8 / 8
Покрытие модели B
7 / 8
Общие
7 общих категорий

Средний балл

Claude Opus 4.6

51.8

Средний балл

GPT-5.4

56.6

Агенты

GPT-5.4 впереди на 2.0

Claude Opus 4.654.3
GPT-5.456.3

Кодинг

GPT-5.4 впереди на 5.5

Claude Opus 4.656.7
GPT-5.462.2

Reasoning

GPT-5.4 впереди на 2.3

Claude Opus 4.653.4
GPT-5.455.7

Знания

GPT-5.4 впереди на 5.2

Claude Opus 4.653.3
GPT-5.458.5

Математика

GPT-5.4 впереди на 1.1

Claude Opus 4.655.7
GPT-5.456.8

Многоязычность

Claude Opus 4.6

Claude Opus 4.648.4
GPT-5.4-

Мультимодальность

GPT-5.4 впереди на 4.7

Claude Opus 4.647.8
GPT-5.452.5

Следование инструкциям

GPT-5.4 впереди на 9.2

Claude Opus 4.644.8
GPT-5.454

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникClaude Opus 4.6

Claude Opus 4.6

62.0

Ранг #41/111 · confidence 4 · дата оценки 2026-02-01

+1.0

GPT-5.4

лидер

63.0

Ранг #40/111 · confidence 4 · дата оценки 2026-03-05

Ценыverified

Input price

Claude Opus 4.6

$5.00/M

Ранг #167/185 · confidence 4

+$2.50/M

GPT-5.4

лидер

$2.50/M

Ранг #153/185 · confidence 4

Ценыverified

Blended price

Claude Opus 4.6

$10.00/M

Ранг #168/185 · confidence 4

+$4.38/M

GPT-5.4

лидер

$5.63/M

Ранг #157/185 · confidence 4

Ценыverified

Output price

Claude Opus 4.6

$25.00/M

Ранг #168/185 · confidence 4

+$10.00/M

GPT-5.4

лидер

$15.00/M

Ранг #158/185 · confidence 4

Reasoningreported

CritPt

ИсточникClaude Opus 4.6

Claude Opus 4.6

2.8

Ранг #57/88 · confidence 4 · дата оценки 2026-02-01

+20.6

GPT-5.4

лидер

23.4

Ранг #11/88 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

AA-LCR

ИсточникClaude Opus 4.6

Claude Opus 4.6

67.0

Ранг #71/106 · confidence 4 · дата оценки 2026-02-01

+15.0

GPT-5.4

лидер

82.0

Ранг #14/106 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

BenchLM Reasoning score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

67.1

Ранг #42/67 · confidence 4 · дата оценки 2026-02-01

+9.9

GPT-5.4

57.2

Ранг #51/67 · confidence 4 · дата оценки 2026-03-05

Reasoningverified

GPQA

Claude Opus 4.6

лидер

84.0%

Ранг #74/217 · confidence 4

+9.2%

GPT-5.4

74.8%

Ранг #121/217 · confidence 4

Reasoningverified

HLE

Claude Opus 4.6

лидер

19.1%

Ранг #87/214 · confidence 4

+7.8%

GPT-5.4

11.3%

Ранг #114/214 · confidence 4

Кодингreported

LiveCodeBench Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

70.7

Ранг #4/4 · confidence 4 · дата оценки 2026-02-01

+16.8

GPT-5.4

лидер

87.5

Ранг #1/4 · confidence 4 · дата оценки 2026-03-05

Кодингreported

React Native Evals

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.1

Ранг #3/12 · confidence 4 · дата оценки 2026-02-01

+1.2

GPT-5.4

лидер

85.3

Ранг #1/12 · confidence 4 · дата оценки 2026-03-05

Кодингreported

Vibe Code Bench

ИсточникClaude Opus 4.6

Claude Opus 4.6

57.6

Ранг #5/33 · confidence 4 · дата оценки 2026-02-01

+9.8

GPT-5.4

лидер

67.4

Ранг #3/33 · confidence 4 · дата оценки 2026-03-05

Кодингreported

AA-SciCode

ИсточникClaude Opus 4.6

Claude Opus 4.6

45.7

Ранг #54/113 · confidence 4 · дата оценки 2026-02-01

+10.9

GPT-5.4

лидер

56.6

Ранг #10/113 · confidence 4 · дата оценки 2026-03-05

Кодингreported

SWE-bench Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

53.4

Ранг #41/50 · confidence 4 · дата оценки 2026-02-01

+4.3

GPT-5.4

лидер

57.7

Ранг #21/50 · confidence 4 · дата оценки 2026-03-05

Кодингreported

BenchLM Coding score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

50.3

Ранг #54/87 · confidence 4 · дата оценки 2026-02-01

+7.5

GPT-5.4

42.8

Ранг #69/87 · confidence 4 · дата оценки 2026-03-05

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникClaude Opus 4.6

Claude Opus 4.6

40.7

Ранг #10/47 · confidence 4 · дата оценки 2026-02-01

+6.9

GPT-5.4

лидер

47.6

Ранг #7/47 · confidence 4 · дата оценки 2026-03-05

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникClaude Opus 4.6

Claude Opus 4.6

22.9

Ранг #11/36 · confidence 4 · дата оценки 2026-02-01

+4.2

GPT-5.4

лидер

27.1

Ранг #9/36 · confidence 4 · дата оценки 2026-03-05

Математикаreported

BenchLM Math score

ИсточникClaude Opus 4.6

Claude Opus 4.6

58.6

Ранг #29/63 · confidence 4 · дата оценки 2026-02-01

+5.9

GPT-5.4

лидер

64.5

Ранг #24/63 · confidence 4 · дата оценки 2026-03-05

Знанияreported

HealthBench Hard

ИсточникClaude Opus 4.6

Claude Opus 4.6

14.8

Ранг #8/8 · confidence 4 · дата оценки 2026-02-01

+25.3

GPT-5.4

лидер

40.1

Ранг #1/8 · confidence 4 · дата оценки 2026-03-05

Знанияreported

MedXpertQA (Text)

ИсточникClaude Opus 4.6

Claude Opus 4.6

52.1

Ранг #3/4 · confidence 4 · дата оценки 2026-02-01

+7.5

GPT-5.4

лидер

59.6

Ранг #2/4 · confidence 4 · дата оценки 2026-03-05

Знанияreported

GPQA-D

ИсточникClaude Opus 4.6

Claude Opus 4.6

89.2

Ранг #19/32 · confidence 4 · дата оценки 2026-02-01

+3.6

GPT-5.4

лидер

92.8

Ранг #9/32 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникClaude Opus 4.6

Claude Opus 4.6

80.1

Ранг #43/106 · confidence 4 · дата оценки 2026-02-01

+11.6

GPT-5.4

лидер

91.7

Ранг #13/106 · confidence 4 · дата оценки 2026-03-05

Знанияreported

HLE w/o tools

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

40.0

Ранг #14/22 · confidence 4 · дата оценки 2026-02-01

+0.2

GPT-5.4

39.8

Ранг #15/22 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-HLE

ИсточникClaude Opus 4.6

Claude Opus 4.6

19.1

Ранг #74/114 · confidence 4 · дата оценки 2026-02-01

+24.6

GPT-5.4

лидер

43.7

Ранг #15/114 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Accuracy

ИсточникClaude Opus 4.6

Claude Opus 4.6

45.8

Ранг #23/106 · confidence 4 · дата оценки 2026-02-01

+5.0

GPT-5.4

лидер

50.8

Ранг #15/106 · confidence 4 · дата оценки 2026-03-05

Знанияreported

BenchLM Knowledge score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

79.8

Ранг #15/83 · confidence 4 · дата оценки 2026-02-01

+5.5

GPT-5.4

74.3

Ранг #30/83 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-GPQA Diamond

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.0

Ранг #67/113 · confidence 4 · дата оценки 2026-02-01

+8.0

GPT-5.4

лидер

92.0

Ранг #21/113 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

2.4

Ранг #36/45 · confidence 4 · дата оценки 2026-02-01

+3.4

GPT-5.4

лидер

5.8

Ранг #28/45 · confidence 4 · дата оценки 2026-03-05

Знанияreported

Artificial Analysis Intelligence Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

26.4

Ранг #57/117 · confidence 4 · дата оценки 2026-02-01

+12.6

GPT-5.4

лидер

39.0

Ранг #28/117 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

MedXpertQA (MM)

ИсточникClaude Opus 4.6

Claude Opus 4.6

64.8

Ранг #6/6 · confidence 4 · дата оценки 2026-02-01

+12.3

GPT-5.4

лидер

77.1

Ранг #3/6 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

ScreenSpot Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

83.1

Ранг #6/12 · confidence 4 · дата оценки 2026-02-01

+2.3

GPT-5.4

лидер

85.4

Ранг #3/12 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

ERQA

ИсточникClaude Opus 4.6

Claude Opus 4.6

51.6

Ранг #8/8 · confidence 4 · дата оценки 2026-02-01

+13.8

GPT-5.4

лидер

65.4

Ранг #5/8 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

MMMU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

77.3

Ранг #21/31 · confidence 4 · дата оценки 2026-02-01

+3.9

GPT-5.4

лидер

81.2

Ранг #7/31 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

Design Arena Website

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

1306.0

Ранг #14/78 · confidence 4 · дата оценки 2026-02-01

+72.0

GPT-5.4

1234.0

Ранг #42/78 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

AA-MMMU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

72.5

Ранг #45/68 · confidence 4 · дата оценки 2026-02-01

+5.9

GPT-5.4

лидер

78.4

Ранг #23/68 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

BenchLM Multimodal Grounded score

ИсточникClaude Opus 4.6

Claude Opus 4.6

59.5

Ранг #40/56 · confidence 4 · дата оценки 2026-02-01

+9.8

GPT-5.4

лидер

69.3

Ранг #28/56 · confidence 4 · дата оценки 2026-03-05

Следование инструкциямreported

BenchLM Instruction Following score

ИсточникClaude Opus 4.6

Claude Opus 4.6

52.6

Ранг #49/52 · confidence 4 · дата оценки 2026-02-01

+38.0

GPT-5.4

лидер

90.6

Ранг #16/52 · confidence 4 · дата оценки 2026-03-05

Следование инструкциямreported

AA-IFBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

44.6

Ранг #59/84 · confidence 4 · дата оценки 2026-02-01

+29.3

GPT-5.4

лидер

73.9

Ранг #21/84 · confidence 4 · дата оценки 2026-03-05

Агентыreported

τ²-bench results

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.8

Ранг #46/82 · confidence 4 · дата оценки 2026-02-01

+14.1

GPT-5.4

лидер

98.9

Ранг #2/82 · confidence 4 · дата оценки 2026-03-05

Агентыreported

Claw-Eval

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

70.4

Ранг #3/27 · confidence 4 · дата оценки 2026-02-01

+10.1

GPT-5.4

60.3

Ранг #13/27 · confidence 4 · дата оценки 2026-03-05

Агентыreported

Gert Labs

ИсточникClaude Opus 4.6

Claude Opus 4.6

61.9

Ранг #10/49 · confidence 4 · дата оценки 2026-02-01

+3.0

GPT-5.4

лидер

64.9

Ранг #4/49 · confidence 4 · дата оценки 2026-03-05

Агентыreported

ResearchClawBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

19.9

Ранг #4/18 · confidence 4 · дата оценки 2026-02-01

+4.6

GPT-5.4

15.3

Ранг #13/18 · confidence 4 · дата оценки 2026-03-05

Агентыreported

CyberGym

ИсточникClaude Opus 4.6

Claude Opus 4.6

66.6

Ранг #11/15 · confidence 4 · дата оценки 2026-02-01

+12.4

GPT-5.4

лидер

79.0

Ранг #6/15 · confidence 4 · дата оценки 2026-03-05

Агентыreported

APEX-Agents-AA

Claude Opus 4.6

33.0

Ранг #8/23 · confidence 1 · дата оценки 2026-02-01

+0.3

GPT-5.4

лидер

33.3

Ранг #7/23 · confidence 4 · дата оценки 2026-03-05

Агентыreported

JobBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

36.7

Ранг #9/24 · confidence 4 · дата оценки 2026-02-01

+2.2

GPT-5.4

лидер

38.9

Ранг #7/24 · confidence 4 · дата оценки 2026-03-05

Агентыreported

BrowseComp

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

83.7

Ранг #11/32 · confidence 4 · дата оценки 2026-02-01

+1.0

GPT-5.4

82.7

Ранг #16/32 · confidence 4 · дата оценки 2026-03-05

Агентыreported

DeepSearchQA

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

73.7

Ранг #11/14 · confidence 4 · дата оценки 2026-02-01

+0.1

GPT-5.4

73.6

Ранг #12/14 · confidence 4 · дата оценки 2026-03-05

Агентыreported

OSWorld-Verified

ИсточникClaude Opus 4.6

Claude Opus 4.6

72.7

Ранг #15/27 · confidence 4 · дата оценки 2026-02-01

+2.3

GPT-5.4

лидер

75.0

Ранг #11/27 · confidence 4 · дата оценки 2026-03-05

Агентыreported

Terminal-Bench 2.0

ИсточникClaude Opus 4.6

Claude Opus 4.6

65.4

Ранг #24/53 · confidence 4 · дата оценки 2026-02-01

+9.7

GPT-5.4

лидер

75.1

Ранг #13/53 · confidence 4 · дата оценки 2026-03-05

Агентыreported

BenchLM Agentic score

ИсточникClaude Opus 4.6

Claude Opus 4.6

63.5

Ранг #36/76 · confidence 4 · дата оценки 2026-02-01

+8.5

GPT-5.4

лидер

72.0

Ранг #28/76 · confidence 4 · дата оценки 2026-03-05

Сравнение аудитов API

Последние завершённые аудиты у общих поставщиков: четыре группы оценок безопасности и целостности со ссылками на отчёты.

Поставщик
Claude Opus 4.6
GPT-5.4
Завершённых аудитов у общих поставщиков пока нет.

Данные поставщиков

Замеры скорости и цены входных и выходных токенов для каждого поставщика помогают выбрать API и оценить стоимость перехода.

Поставщик
Claude Opus 4.6
GPT-5.4
天宫造物50 тестов

Claude Opus 4.6

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

50 tok/s / 7305ms

ввод / вывод

Нет данных

巨量API49 тестов

Claude Opus 4.6

скорость / задержка

24 tok/s / 7946ms

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

43 tok/s / 12778ms

ввод / вывод

Нет данных

Kunkunout API20 тестов

Claude Opus 4.6

скорость / задержка

40 tok/s / 16141ms

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Sub2API20 тестов

Claude Opus 4.6

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

34 tok/s / 1748ms

ввод / вывод

Нет данных

钠 API20 тестов

Claude Opus 4.6

скорость / задержка

42 tok/s / 2282ms

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$40.15/M/$200.75/M

GPT-5.4

gpt-5.4-2026-03-05

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$3.84/M/$19.18/M

GPT-5.4

gpt-5.4

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.240/M/$1.20/M

GPT-5.4

gpt-5-4

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

GPT-5.4

gpt-5.4

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0/request

GPT-5.4

gpt-5.4-2026-03-05

скорость / задержка

Нет данных

ввод / вывод

$0/request

Частые вопросы

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Почему это сравнение доступно в поиске?
В сравнении есть проверяемые показатели (6), а для обеих моделей доступны цены или результаты замеров.
Выдумываются ли недостающие показатели?
Нет. Показатели, для которых у LMSpeed нет данных, не включаются в отчёт.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.