Вернуться к моделям

Сравнение моделей

Claude Opus 4.6 vs GPT-5.3 Codex

Краткий вывод по Claude Opus 4.6 и GPT-5.3 Codex перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.3 Codex. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.3 Codex

GPT-5.3 Codex имеет более высокий взвешенный результат; баллы модели A / B — 17.3 к 82.7.

Глубина данных

130 точек данных

Включает 33 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.3 Codex

Графики ниже разделяют 43 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.3 Codex: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Сравнение моделей
Claude Opus 4.6
GPT-5.3 Codex
Общий лидерСоперникЛидирует
Итоговый взвешенный балл17.3 балла82.7 балла
Лидерство в категориях benchmark1 категорий5 категорий
Операционные преимуществаМинимальная цена вводаСредняя скорость, Задержка первого токена, Бесплатные поставщики, Набор поставщиков
Контекстное окно1M токенов400K токенов
Макс. вывод128K токенов128K токенов
Модальности

Вход

ТекстИзображениеФайл

Выход

Текст

Вход

ТекстИзображениеФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Сравнение моделей
Claude Opus 4.6
GPT-5.3 Codex
РазработчикAnthropicOpenAI
Выпущенафевр. 2026 г.февр. 2026 г.
ПараметрыНет данныхНет данных
ТокенизаторClaudeGPT
Срез знанийНет данныхНет данных
OpenRouter IDanthropic/claude-opus-4.6openai/gpt-5.3-codex
СсылкиНет данныхНет данных

Когда выбирать каждую модель

Отчёт использует данные LMSpeed о Claude Opus 4.6 и GPT-5.3 Codex: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Claude Opus 4.6

Claude Opus 4.6 сильнее в категориях benchmark (Агенты) и операционных измерениях (Минимальная цена ввода).

GPT-5.3 Codex

GPT-5.3 Codex сильнее в категориях benchmark (Кодинг, Reasoning, Знания, Мультимодальность, Следование инструкциям) и операционных измерениях (Средняя скорость, Задержка первого токена, Бесплатные поставщики, Набор поставщиков).

Сравнение результатов тестов

Независимые тесты, собранные LMSpeed. Показаны только показатели, доступные для обеих моделей.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
8 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

Claude Opus 4.6

51.8

Средний балл

GPT-5.3 Codex

55.3

Агенты

Claude Opus 4.6 впереди на 2.2

Claude Opus 4.654.3
GPT-5.3 Codex52.1

Кодинг

GPT-5.3 Codex впереди на 0.5

Claude Opus 4.656.6
GPT-5.3 Codex57.1

Reasoning

GPT-5.3 Codex впереди на 6.4

Claude Opus 4.653.4
GPT-5.3 Codex59.8

Знания

GPT-5.3 Codex впереди на 3.8

Claude Opus 4.653.3
GPT-5.3 Codex57.1

Математика

Claude Opus 4.6

Claude Opus 4.655.7
GPT-5.3 Codex-

Многоязычность

Claude Opus 4.6

Claude Opus 4.648.4
GPT-5.3 Codex-

Мультимодальность

GPT-5.3 Codex впереди на 3.0

Claude Opus 4.647.8
GPT-5.3 Codex50.8

Следование инструкциям

GPT-5.3 Codex впереди на 9.8

Claude Opus 4.644.8
GPT-5.3 Codex54.6

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникClaude Opus 4.6

Claude Opus 4.6

62.0

Ранг #41/111 · confidence 4 · дата оценки 2026-02-01

+6.0

GPT-5.3 Codex

лидер

68.0

Ранг #26/111 · confidence 3 · дата оценки 2026-02-05

Ценыverified

Input price

Claude Opus 4.6

$5.00/M

Ранг #168/186 · confidence 4

+$3.25/M

GPT-5.3 Codex

лидер

$1.75/M

Ранг #140/186 · confidence 4

Ценыverified

Blended price

Claude Opus 4.6

$10.00/M

Ранг #169/186 · confidence 4

+$5.19/M

GPT-5.3 Codex

лидер

$4.81/M

Ранг #155/186 · confidence 4

Ценыverified

Output price

Claude Opus 4.6

$25.00/M

Ранг #169/186 · confidence 4

+$11.00/M

GPT-5.3 Codex

лидер

$14.00/M

Ранг #156/186 · confidence 4

Reasoningreported

BenchLM Reasoning score

ИсточникClaude Opus 4.6

Claude Opus 4.6

67.1

Ранг #42/67 · confidence 4 · дата оценки 2026-02-01

+11.2

GPT-5.3 Codex

лидер

78.3

Ранг #5/67 · confidence 3 · дата оценки 2026-02-05

Reasoningreported

AA-LCR

ИсточникClaude Opus 4.6

Claude Opus 4.6

67.0

Ранг #71/106 · confidence 4 · дата оценки 2026-02-01

+16.3

GPT-5.3 Codex

лидер

83.3

Ранг #6/106 · confidence 3 · дата оценки 2026-02-05

Reasoningverified

GPQA

Claude Opus 4.6

84.0%

Ранг #75/218 · confidence 4

+7.5%

GPT-5.3 Codex

лидер

91.5%

Ранг #21/218 · confidence 4

Reasoningreported

CritPt

ИсточникClaude Opus 4.6

Claude Opus 4.6

2.8

Ранг #57/88 · confidence 4 · дата оценки 2026-02-01

+14.1

GPT-5.3 Codex

лидер

16.9

Ранг #22/88 · confidence 3 · дата оценки 2026-02-05

Reasoningverified

HLE

Claude Opus 4.6

19.1%

Ранг #89/216 · confidence 4

+23.4%

GPT-5.3 Codex

лидер

42.5%

Ранг #22/216 · confidence 4

Кодингreported

SWE-Rebench

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

65.3

Ранг #1/11 · confidence 4 · дата оценки 2026-02-01

+7.1

GPT-5.3 Codex

58.2

Ранг #9/11 · confidence 3 · дата оценки 2026-02-05

Кодингreported

Vibe Code Bench

ИсточникClaude Opus 4.6

Claude Opus 4.6

57.6

Ранг #5/33 · confidence 4 · дата оценки 2026-02-01

+4.2

GPT-5.3 Codex

лидер

61.8

Ранг #4/33 · confidence 3 · дата оценки 2026-02-05

Кодингreported

SWE-bench Verified

ИсточникClaude Opus 4.6

Claude Opus 4.6

80.8

Ранг #8/49 · confidence 4 · дата оценки 2026-02-01

+4.2

GPT-5.3 Codex

лидер

85.0

Ранг #6/49 · confidence 3 · дата оценки 2026-02-05

Кодингreported

AA-SciCode

ИсточникClaude Opus 4.6

Claude Opus 4.6

45.7

Ранг #54/113 · confidence 4 · дата оценки 2026-02-01

+7.5

GPT-5.3 Codex

лидер

53.2

Ранг #26/113 · confidence 3 · дата оценки 2026-02-05

Кодингreported

SWE-bench Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

53.4

Ранг #41/50 · confidence 4 · дата оценки 2026-02-01

+3.4

GPT-5.3 Codex

лидер

56.8

Ранг #26/50 · confidence 3 · дата оценки 2026-02-05

Кодингreported

BenchLM Coding score

ИсточникClaude Opus 4.6

Claude Opus 4.6

50.3

Ранг #54/87 · confidence 4 · дата оценки 2026-02-01

+1.7

GPT-5.3 Codex

лидер

52.0

Ранг #50/87 · confidence 3 · дата оценки 2026-02-05

Знанияreported

AA-Omniscience Accuracy

ИсточникClaude Opus 4.6

Claude Opus 4.6

45.8

Ранг #23/106 · confidence 4 · дата оценки 2026-02-01

+7.1

GPT-5.3 Codex

лидер

52.9

Ранг #11/106 · confidence 3 · дата оценки 2026-02-05

Знанияreported

BenchLM Knowledge score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

79.8

Ранг #15/83 · confidence 4 · дата оценки 2026-02-01

+0.3

GPT-5.3 Codex

79.5

Ранг #19/83 · confidence 3 · дата оценки 2026-02-05

Знанияreported

AA-HLE

ИсточникClaude Opus 4.6

Claude Opus 4.6

19.1

Ранг #74/114 · confidence 4 · дата оценки 2026-02-01

+23.4

GPT-5.3 Codex

лидер

42.5

Ранг #21/114 · confidence 3 · дата оценки 2026-02-05

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникClaude Opus 4.6

Claude Opus 4.6

80.1

Ранг #43/106 · confidence 4 · дата оценки 2026-02-01

+9.1

GPT-5.3 Codex

лидер

89.2

Ранг #21/106 · confidence 3 · дата оценки 2026-02-05

Знанияreported

AA-GPQA Diamond

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.0

Ранг #67/113 · confidence 4 · дата оценки 2026-02-01

+7.5

GPT-5.3 Codex

лидер

91.5

Ранг #23/113 · confidence 3 · дата оценки 2026-02-05

Знанияreported

AA-Omniscience Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

2.4

Ранг #36/45 · confidence 4 · дата оценки 2026-02-01

+8.5

GPT-5.3 Codex

лидер

10.9

Ранг #25/45 · confidence 3 · дата оценки 2026-02-05

Знанияreported

Artificial Analysis Intelligence Index

ИсточникClaude Opus 4.6

Claude Opus 4.6

26.4

Ранг #57/117 · confidence 4 · дата оценки 2026-02-01

+6.1

GPT-5.3 Codex

лидер

32.5

Ранг #43/117 · confidence 3 · дата оценки 2026-02-05

Мультимодальностьreported

Design Arena Website

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

1306.0

Ранг #14/78 · confidence 4 · дата оценки 2026-02-01

+129.0

GPT-5.3 Codex

1177.0

Ранг #59/78 · confidence 3 · дата оценки 2026-02-05

Мультимодальностьreported

BenchLM Multimodal Grounded score

ИсточникClaude Opus 4.6

Claude Opus 4.6

59.5

Ранг #40/56 · confidence 4 · дата оценки 2026-02-01

+16.1

GPT-5.3 Codex

лидер

75.6

Ранг #20/56 · confidence 3 · дата оценки 2026-02-05

Мультимодальностьreported

AA-MMMU-Pro

ИсточникClaude Opus 4.6

Claude Opus 4.6

72.5

Ранг #45/68 · confidence 4 · дата оценки 2026-02-01

+6.0

GPT-5.3 Codex

лидер

78.5

Ранг #22/68 · confidence 3 · дата оценки 2026-02-05

Следование инструкциямreported

BenchLM Instruction Following score

ИсточникClaude Opus 4.6

Claude Opus 4.6

52.6

Ранг #49/52 · confidence 4 · дата оценки 2026-02-01

+40.0

GPT-5.3 Codex

лидер

92.6

Ранг #10/52 · confidence 3 · дата оценки 2026-02-05

Следование инструкциямreported

AA-IFBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

44.6

Ранг #59/84 · confidence 4 · дата оценки 2026-02-01

+30.8

GPT-5.3 Codex

лидер

75.4

Ранг #18/84 · confidence 3 · дата оценки 2026-02-05

Агентыreported

JobBench

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

36.7

Ранг #9/24 · confidence 4 · дата оценки 2026-02-01

+3.0

GPT-5.3 Codex

33.7

Ранг #11/24 · confidence 3 · дата оценки 2026-02-05

Агентыreported

Gert Labs

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

61.9

Ранг #10/49 · confidence 4 · дата оценки 2026-02-01

+4.4

GPT-5.3 Codex

57.5

Ранг #13/49 · confidence 3 · дата оценки 2026-02-05

Агентыreported

Terminal-Bench 2.0

ИсточникClaude Opus 4.6

Claude Opus 4.6

65.4

Ранг #24/53 · confidence 4 · дата оценки 2026-02-01

+11.9

GPT-5.3 Codex

лидер

77.3

Ранг #11/53 · confidence 3 · дата оценки 2026-02-05

Агентыreported

OSWorld-Verified

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

72.7

Ранг #15/27 · confidence 4 · дата оценки 2026-02-01

+8.0

GPT-5.3 Codex

64.7

Ранг #21/27 · confidence 3 · дата оценки 2026-02-05

Агентыreported

BenchLM Agentic score

ИсточникClaude Opus 4.6

Claude Opus 4.6

лидер

63.5

Ранг #36/76 · confidence 4 · дата оценки 2026-02-01

+0.7

GPT-5.3 Codex

62.8

Ранг #37/76 · confidence 3 · дата оценки 2026-02-05

Агентыreported

τ²-bench results

ИсточникClaude Opus 4.6

Claude Opus 4.6

84.8

Ранг #46/82 · confidence 4 · дата оценки 2026-02-01

+1.2

GPT-5.3 Codex

лидер

86.0

Ранг #42/82 · confidence 3 · дата оценки 2026-02-05

Сравнение аудитов API

Последние завершённые аудиты у общих поставщиков: четыре группы оценок безопасности и целостности со ссылками на отчёты.

Поставщик
Claude Opus 4.6
GPT-5.3 Codex
Завершённых аудитов у общих поставщиков пока нет.

Данные поставщиков

Замеры скорости и цены входных и выходных токенов для каждого поставщика помогают выбрать API и оценить стоимость перехода.

Поставщик
Claude Opus 4.6
GPT-5.3 Codex
UoCode30 тестов

Claude Opus 4.6

скорость / задержка

38 tok/s / 2611ms

ввод / вывод

Нет данных

GPT-5.3 Codex

скорость / задержка

56 tok/s / 4621ms

ввод / вывод

Нет данных

钠 API25 тестов

Claude Opus 4.6

скорость / задержка

42 tok/s / 2282ms

ввод / вывод

Нет данных

GPT-5.3 Codex

скорость / задержка

63 tok/s / 3786ms

ввод / вывод

Нет данных

Kunkunout API20 тестов

Claude Opus 4.6

скорость / задержка

40 tok/s / 16141ms

ввод / вывод

Нет данных

GPT-5.3 Codex

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Rnglg2 API15 тестов

Claude Opus 4.6

скорость / задержка

57 tok/s / 3926ms

ввод / вывод

Нет данных

GPT-5.3 Codex

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

小水管 API15 тестов

Claude Opus 4.6

скорость / задержка

45 tok/s / 6167ms

ввод / вывод

Нет данных

GPT-5.3 Codex

скорость / задержка

201 tok/s / 2135ms

ввод / вывод

Нет данных

Claude Opus 4.6

claude-opus-4-6-low

скорость / задержка

Нет данных

ввод / вывод

$0/request

GPT-5.3 Codex

gpt-5.3-codex

скорость / задержка

Нет данных

ввод / вывод

$0/request

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.017/request

GPT-5.3 Codex

gpt-5.3-codex-medium

скорость / задержка

Нет данных

ввод / вывод

$0.0068/request

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.365/request

GPT-5.3 Codex

gpt-5.3-codex-spark

скорость / задержка

Нет данных

ввод / вывод

$0.0073/request

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.131/M/$0.654/M

GPT-5.3 Codex

gpt-5.3-codex-spark

скорость / задержка

Нет данных

ввод / вывод

$0.019/M/$0.153/M

Claude Opus 4.6

claude-opus-4-6

скорость / задержка

Нет данных

ввод / вывод

$0.131/M/$0.654/M

GPT-5.3 Codex

gpt-5.3-codex-spark

скорость / задержка

Нет данных

ввод / вывод

$0.019/M/$0.153/M

Частые вопросы

Взвешенный результат: GPT-5.3 Codex. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Почему это сравнение доступно в поиске?
В сравнении есть проверяемые показатели (6), а для обеих моделей доступны цены или результаты замеров.
Выдумываются ли недостающие показатели?
Нет. Показатели, для которых у LMSpeed нет данных, не включаются в отчёт.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.