Вернуться к моделям

Сравнение моделей

Claude Opus 4.6 vs GPT-5.4 Mini

Краткий вывод по Claude Opus 4.6 и GPT-5.4 Mini перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.4 Mini. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.4 Mini

GPT-5.4 Mini имеет более высокий взвешенный результат; баллы модели A / B — 49.7 к 50.3.

Глубина данных

131 точек данных

Включает 33 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.4 Mini

Графики ниже разделяют 43 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.4 Mini: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Сравнение моделей
Claude Opus 4.6
GPT-5.4 Mini
Общий лидерСоперникЛидирует
Итоговый взвешенный балл49.7 балла50.3 балла
Лидерство в категориях benchmark4 категорий3 категорий
Операционные преимуществаБесплатные поставщикиМинимальная цена ввода, Средняя скорость, Задержка первого токена, Набор поставщиков
Контекстное окно1M токенов400K токенов
Макс. вывод128K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ФайлИзображениеТекст

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Сравнение моделей
Claude Opus 4.6
GPT-5.4 Mini
РазработчикAnthropicOpenAI
Выпущенафевр. 2026 г.март 2026 г.
ПараметрыНет данныхНет данных
ТокенизаторClaudeGPT
Срез знанийНет данных2025-08-31
OpenRouter IDanthropic/claude-opus-4.6openai/gpt-5.4-mini
СсылкиНет данныхНет данных

Когда выбирать каждую модель

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.4 Mini: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Claude Opus 4.6

Claude Opus 4.6 сильнее в категориях benchmark (Агенты, Знания, Математика, Мультимодальность) и операционных измерениях (Бесплатные поставщики).

GPT-5.4 Mini

GPT-5.4 Mini сильнее в категориях benchmark (Кодинг, Reasoning, Следование инструкциям) и операционных измерениях (Минимальная цена ввода, Средняя скорость, Задержка первого токена, Набор поставщиков).

Сравнение результатов тестов

Независимые тесты, собранные LMSpeed. Показаны только показатели, доступные для обеих моделей.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
8 / 8
Покрытие модели B
7 / 8
Общие
7 общих категорий

Средний балл

Claude Opus 4.6

51.8

Средний балл

GPT-5.4 Mini

51.1

Агенты

Claude Opus 4.6 впереди на 4.2

Claude Opus 4.654.3
GPT-5.4 Mini50.1

Кодинг

GPT-5.4 Mini впереди на 0.2

Claude Opus 4.656.6
GPT-5.4 Mini56.8

Reasoning

GPT-5.4 Mini впереди на 2.0

Claude Opus 4.653.4
GPT-5.4 Mini55.4

Знания

Claude Opus 4.6 впереди на 7.9

Claude Opus 4.653.3
GPT-5.4 Mini45.4

Математика

Claude Opus 4.6 впереди на 6.4

Claude Opus 4.655.7
GPT-5.4 Mini49.3

Многоязычность

Claude Opus 4.6

Claude Opus 4.648.4
GPT-5.4 Mini-

Мультимодальность

Claude Opus 4.6 впереди на 0.7

Claude Opus 4.647.8
GPT-5.4 Mini47.1

Следование инструкциям

GPT-5.4 Mini впереди на 9.0

Claude Opus 4.644.8
GPT-5.4 Mini53.8

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

62.0

Ранг #41/111 · confidence 4 · дата оценки 2026-02-01

+2.0

GPT-5.4 Mini

60.0

Ранг #47/111 · confidence 4 · дата оценки 2026-03-17

Ценыverified

Input price

Claude Opus 4.6

$5.00/M

Ранг #168/186 · confidence 4

+$4.25/M

GPT-5.4 Mini

лидер

$0.750/M

Ранг #107/186 · confidence 4

Ценыverified

Blended price

Claude Opus 4.6

$10.00/M

Ранг #169/186 · confidence 4

+$8.31/M

GPT-5.4 Mini

лидер

$1.69/M

Ранг #113/186 · confidence 4

Ценыverified

Output price

Claude Opus 4.6

$25.00/M

Ранг #169/186 · confidence 4

+$20.50/M

GPT-5.4 Mini

лидер

$4.50/M

Ранг #125/186 · confidence 4

Reasoningreported

BenchLM Reasoning score

ИсточникClaude Opus 4.6

Claude Opus 4.6

67.1

Ранг #42/67 · confidence 4 · дата оценки 2026-02-01

+6.8

GPT-5.4 Mini

лидер

73.9

Ранг #29/67 · confidence 4 · дата оценки 2026-03-17

Reasoningreported

CritPt

ИсточникClaude Opus 4.6

Claude Opus 4.6

2.8

Ранг #57/88 · confidence 4 · дата оценки 2026-02-01

+7.2

GPT-5.4 Mini

лидер

10.0

Ранг #33/88 · confidence 4 · дата оценки 2026-03-17

Reasoningreported

AA-LCR

ИсточникClaude Opus 4.6

Claude Opus 4.6

67.0

Ранг #71/106 · confidence 4 · дата оценки 2026-02-01

+10.0

GPT-5.4 Mini

лидер

77.0

Ранг #43/106 · confidence 4 · дата оценки 2026-03-17

Reasoningverified

GPQA

Claude Opus 4.6

лидер

84.0%

Ранг #75/218 · confidence 4

+1.7%

GPT-5.4 Mini

82.3%

Ранг #87/218 · confidence 4

Reasoningverified

HLE

Claude Opus 4.6

лидер

19.1%

Ранг #89/216 · confidence 4

+0.5%

GPT-5.4 Mini

18.6%

Ранг #91/216 · confidence 4

Кодингreported

Vibe Code Bench

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

57.6

Ранг #5/33 · confidence 4 · дата оценки 2026-02-01

+9.6

GPT-5.4 Mini

48.0

Ранг #10/33 · confidence 4 · дата оценки 2026-03-17

Кодингreported

FrontierCode 1.1 Main

ИсточникClaude Opus 4.6

Claude Opus 4.6

26.9

Ранг #10/11 · confidence 4 · дата оценки 2026-02-01

+0.1

GPT-5.4 Mini

лидер

27.0

Ранг #9/11 · confidence 4 · дата оценки 2026-03-17

Кодингreported

AA-SciCode

ИсточникClaude Opus 4.6

Claude Opus 4.6

45.7

Ранг #54/113 · confidence 4 · дата оценки 2026-02-01

+6.4

GPT-5.4 Mini

лидер

52.1

Ранг #28/113 · confidence 4 · дата оценки 2026-03-17

Кодингreported

BenchLM Coding score

ИсточникClaude Opus 4.6

Claude Opus 4.6

50.3

Ранг #54/87 · confidence 4 · дата оценки 2026-02-01

+5.7

GPT-5.4 Mini

лидер

56.0

Ранг #36/87 · confidence 4 · дата оценки 2026-03-17

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

40.7

Ранг #10/47 · confidence 4 · дата оценки 2026-02-01

+12.4

GPT-5.4 Mini

28.3

Ранг #20/47 · confidence 4 · дата оценки 2026-03-17

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

22.9

Ранг #11/36 · confidence 4 · дата оценки 2026-02-01

+20.8

GPT-5.4 Mini

2.1

Ранг #36/36 · confidence 4 · дата оценки 2026-03-17

Математикаreported

BenchLM Math score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

58.6

Ранг #29/63 · confidence 4 · дата оценки 2026-02-01

+14.1

GPT-5.4 Mini

44.5

Ранг #39/63 · confidence 4 · дата оценки 2026-03-17

Знанияreported

HLE w/o tools

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

40.0

Ранг #14/22 · confidence 4 · дата оценки 2026-02-01

+11.8

GPT-5.4 Mini

28.2

Ранг #21/22 · confidence 4 · дата оценки 2026-03-17

Знанияreported

BenchLM Knowledge score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

79.8

Ранг #15/83 · confidence 4 · дата оценки 2026-02-01

+22.8

GPT-5.4 Mini

57.0

Ранг #62/83 · confidence 4 · дата оценки 2026-03-17

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникClaude Opus 4.6

Claude Opus 4.6

80.1

Ранг #43/106 · confidence 4 · дата оценки 2026-02-01

+10.1

GPT-5.4 Mini

лидер

90.2

Ранг #18/106 · confidence 4 · дата оценки 2026-03-17

Знанияreported

AA-Omniscience Accuracy

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

45.8

Ранг #23/106 · confidence 4 · дата оценки 2026-02-01

+8.3

GPT-5.4 Mini

37.5

Ранг #44/106 · confidence 4 · дата оценки 2026-03-17

Знанияreported

AA-GPQA Diamond

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.0

Ранг #67/113 · confidence 4 · дата оценки 2026-02-01

+3.5

GPT-5.4 Mini

лидер

87.5

Ранг #46/113 · confidence 4 · дата оценки 2026-03-17

Знанияreported

AA-HLE

ИсточникClaude Opus 4.6

Claude Opus 4.6

19.1

Ранг #74/114 · confidence 4 · дата оценки 2026-02-01

+9.0

GPT-5.4 Mini

лидер

28.1

Ранг #54/114 · confidence 4 · дата оценки 2026-03-17

Знанияreported

Artificial Analysis Intelligence Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

26.4

Ранг #57/117 · confidence 4 · дата оценки 2026-02-01

+1.8

GPT-5.4 Mini

24.6

Ранг #69/117 · confidence 4 · дата оценки 2026-03-17

Мультимодальностьreported

MMMU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

77.3

Ранг #21/31 · confidence 4 · дата оценки 2026-02-01

+0.7

GPT-5.4 Mini

76.6

Ранг #22/31 · confidence 4 · дата оценки 2026-03-17

Мультимодальностьreported

BenchLM Multimodal Grounded score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

59.5

Ранг #40/56 · confidence 4 · дата оценки 2026-02-01

+2.3

GPT-5.4 Mini

57.2

Ранг #41/56 · confidence 4 · дата оценки 2026-03-17

Мультимодальностьreported

AA-MMMU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

72.5

Ранг #45/68 · confidence 4 · дата оценки 2026-02-01

+0.8

GPT-5.4 Mini

лидер

73.3

Ранг #42/68 · confidence 4 · дата оценки 2026-03-17

Следование инструкциямreported

BenchLM Instruction Following score

ИсточникClaude Opus 4.6

Claude Opus 4.6

52.6

Ранг #49/52 · confidence 4 · дата оценки 2026-02-01

+37.2

GPT-5.4 Mini

лидер

89.8

Ранг #17/52 · confidence 4 · дата оценки 2026-03-17

Следование инструкциямreported

AA-IFBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

44.6

Ранг #59/84 · confidence 4 · дата оценки 2026-02-01

+28.7

GPT-5.4 Mini

лидер

73.3

Ранг #23/84 · confidence 4 · дата оценки 2026-03-17

Агентыreported

APEX-Agents-AA

Claude Opus 4.6

лидер

33.0

Ранг #8/23 · confidence 1 · дата оценки 2026-02-01

+4.8

GPT-5.4 Mini

28.2

Ранг #11/23 · confidence 4 · дата оценки 2026-03-17

Агентыreported

OSWorld-Verified

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

72.7

Ранг #15/27 · confidence 4 · дата оценки 2026-02-01

+0.6

GPT-5.4 Mini

72.1

Ранг #16/27 · confidence 4 · дата оценки 2026-03-17

Агентыreported

Terminal-Bench 2.0

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

65.4

Ранг #24/53 · confidence 4 · дата оценки 2026-02-01

+5.4

GPT-5.4 Mini

60.0

Ранг #31/53 · confidence 4 · дата оценки 2026-03-17

Агентыreported

τ²-bench results

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.8

Ранг #46/82 · confidence 4 · дата оценки 2026-02-01

+8.6

GPT-5.4 Mini

лидер

93.4

Ранг #28/82 · confidence 4 · дата оценки 2026-03-17

Агентыreported

BenchLM Agentic score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

63.5

Ранг #36/76 · confidence 4 · дата оценки 2026-02-01

+7.9

GPT-5.4 Mini

55.6

Ранг #48/76 · confidence 4 · дата оценки 2026-03-17

Сравнение аудитов API

Последние завершённые аудиты у общих поставщиков: четыре группы оценок безопасности и целостности со ссылками на отчёты.

Поставщик
Claude Opus 4.6
GPT-5.4 Mini
Завершённых аудитов у общих поставщиков пока нет.

Данные поставщиков

Замеры скорости и цены входных и выходных токенов для каждого поставщика помогают выбрать API и оценить стоимость перехода.

Поставщик
Claude Opus 4.6
GPT-5.4 Mini
XShuLab Sub2API25 тестов

Claude Opus 4.6

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4 Mini

скорость / задержка

139 tok/s / 2844ms

ввод / вывод

Нет данных

发现AI22 тестов

Claude Opus 4.6

скорость / задержка

39 tok/s / 9397ms

ввод / вывод

Нет данных

GPT-5.4 Mini

скорость / задержка

108 tok/s / 1950ms

ввод / вывод

Нет данных

Kunkunout API20 тестов

Claude Opus 4.6

скорость / задержка

40 tok/s / 16141ms

ввод / вывод

Нет данных

GPT-5.4 Mini

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

钠 API20 тестов

Claude Opus 4.6

скорость / задержка

42 tok/s / 2282ms

ввод / вывод

Нет данных

GPT-5.4 Mini

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Rnglg2 API15 тестов

Claude Opus 4.6

скорость / задержка

57 tok/s / 3926ms

ввод / вывод

Нет данных

GPT-5.4 Mini

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Claude Opus 4.6

claude-opus-4-6-low

скорость / задержка

Нет данных

ввод / вывод

$0/request

GPT-5.4 Mini

gpt-5.4-mini

скорость / задержка

Нет данных

ввод / вывод

$0/request

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.185/M/$0.925/M

GPT-5.4 Mini

gpt-5.4-mini

скорость / задержка

Нет данных

ввод / вывод

$0.011/M/$0.067/M

Claude Opus 4.6

anthropic/claude-opus-4.6

скорость / задержка

Нет данных

ввод / вывод

$0.589/M/$2.88/M

GPT-5.4 Mini

gpt-5.4-mini

скорость / задержка

Нет данных

ввод / вывод

$0.014/M/$0.082/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.365/request

GPT-5.4 Mini

gpt-5.4-mini

скорость / задержка

Нет данных

ввод / вывод

$0.015/request

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.017/request

GPT-5.4 Mini

gpt-5.4-mini

скорость / задержка

Нет данных

ввод / вывод

$0.051/M/$0.308/M

Частые вопросы

Взвешенный результат: GPT-5.4 Mini. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Почему это сравнение доступно в поиске?
В сравнении есть проверяемые показатели (6), а для обеих моделей доступны цены или результаты замеров.
Выдумываются ли недостающие показатели?
Нет. Показатели, для которых у LMSpeed нет данных, не включаются в отчёт.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.