Вернуться к моделям

Сравнение моделей

GPT-5.2 vs O3

Краткий вывод по GPT-5.2 и O3 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.2. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.2

GPT-5.2 имеет более высокий взвешенный результат; баллы модели A / B — 52 к 48.

Глубина данных

109 точек данных

Включает 22 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.2

Графики ниже разделяют 32 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

Отчёт использует данные LMSpeed о GPT-5.2 и O3: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Сравнение моделей
GPT-5.2
O3
Общий лидерЛидируетСоперник
Итоговый взвешенный балл52.0 балла48.0 балла
Лидерство в категориях benchmark3 категорий3 категорий
Операционные преимуществаМинимальная цена ввода, Бесплатные поставщики, Набор поставщиковСредняя скорость, Задержка первого токена
Контекстное окно400K токенов200K токенов
Макс. вывод128K токенов100K токенов
Модальности

Вход

ФайлИзображениеТекст

Выход

Текст

Вход

ИзображениеТекстФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Сравнение моделей
GPT-5.2
O3
РазработчикOpenAIOpenAI
Выпущенадек. 2025 г.апр. 2025 г.
ПараметрыНет данныхНет данных
ТокенизаторGPTGPT
Срез знанийНет данных2024-06-30
OpenRouter IDopenai/gpt-5.2openai/o3
СсылкиНет данныхНет данных

Когда выбирать каждую модель

Отчёт использует данные LMSpeed о GPT-5.2 и O3: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

GPT-5.2

GPT-5.2 сильнее в категориях benchmark (Кодинг, Знания, Следование инструкциям) и операционных измерениях (Минимальная цена ввода, Бесплатные поставщики, Набор поставщиков).

O3

O3 сильнее в категориях benchmark (Агенты, Reasoning, Математика) и операционных измерениях (Средняя скорость, Задержка первого токена).

Сравнение результатов тестов

Независимые тесты, собранные LMSpeed. Показаны только показатели, доступные для обеих моделей.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
7 / 8
Покрытие модели B
6 / 8
Общие
6 общих категорий

Средний балл

GPT-5.2

51.8

Средний балл

O3

52.6

Агенты

O3 впереди на 2.2

GPT-5.247
O349.2

Кодинг

GPT-5.2 впереди на 3.2

GPT-5.256.3
O353.1

Reasoning

O3 впереди на 0.5

GPT-5.253.1
O353.6

Знания

GPT-5.2 впереди на 6.8

GPT-5.254.4
O347.6

Математика

O3 впереди на 3.4

GPT-5.255.3
O358.7

Многоязычность

Нет данных

GPT-5.2-
O3-

Мультимодальность

GPT-5.2

GPT-5.242.2
O3-

Следование инструкциям

GPT-5.2 впереди на 1.5

GPT-5.254.6
O353.1

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникGPT-5.2

GPT-5.2

лидер

51.0

Ранг #78/111 · confidence 4 · дата оценки 2025-12-11

+1.0

O3

50.0

Ранг #82/111 · confidence 1 · дата оценки 2025-04-16

Ценыverified

Output price

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

$14.00/M

Ранг #156/186 · confidence 4

+$6.00/M

O3

лидер

$8.00/M

Ранг #138/186 · confidence 4

Ценыverified

Input price

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

лидер

$1.75/M

Ранг #140/186 · confidence 4

+$0.250/M

O3

$2.00/M

Ранг #143/186 · confidence 4

Ценыverified

Blended price

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

$4.81/M

Ранг #155/186 · confidence 4

+$1.31/M

O3

лидер

$3.50/M

Ранг #145/186 · confidence 4

Reasoningreported

AA-LCR

ИсточникGPT-5.2

GPT-5.2

лидер

82.7

Ранг #11/106 · confidence 4 · дата оценки 2025-12-11

+9.4

O3

73.3

Ранг #55/106 · confidence 1 · дата оценки 2025-04-16

Reasoningverified

MMLU-Pro

ИсточникGPT-5.2 (xhigh)

GPT-5.2

лидер

87.4%

Ранг #11/129 · confidence 4

+2.1%

O3

85.3%

Ранг #27/129 · confidence 4

Reasoningreported

CritPt

ИсточникGPT-5.2

GPT-5.2

лидер

11.6

Ранг #31/88 · confidence 4 · дата оценки 2025-12-11

+10.5

O3

1.1

Ранг #69/88 · confidence 1 · дата оценки 2025-04-16

Reasoningverified

GPQA

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

71.2%

Ранг #138/218 · confidence 4

+11.5%

O3

лидер

82.7%

Ранг #83/218 · confidence 4

Reasoningverified

HLE

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

8.0%

Ранг #134/216 · confidence 4

+12.1%

O3

лидер

20.1%

Ранг #86/216 · confidence 4

Кодингverified

LiveCodeBench

ИсточникGPT-5.2 (Non-reasoning)

GPT-5.2

66.9%

Ранг #36/115 · confidence 4

+13.9%

O3

лидер

80.8%

Ранг #16/115 · confidence 4

Кодингreported

AA-SciCode

ИсточникGPT-5.2

GPT-5.2

лидер

52.1

Ранг #28/113 · confidence 4 · дата оценки 2025-12-11

+11.1

O3

41.0

Ранг #67/113 · confidence 1 · дата оценки 2025-04-16

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникGPT-5.2

GPT-5.2

лидер

40.7

Ранг #10/47 · confidence 4 · дата оценки 2025-12-11

+22.0

O3

18.7

Ранг #30/47 · confidence 1 · дата оценки 2025-04-16

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникGPT-5.2

GPT-5.2

лидер

18.8

Ранг #12/36 · confidence 4 · дата оценки 2025-12-11

+16.7

O3

2.1

Ранг #33/36 · confidence 1 · дата оценки 2025-04-16

Математикаreported

BenchLM Math score

ИсточникGPT-5.2

GPT-5.2

лидер

57.5

Ранг #31/63 · confidence 4 · дата оценки 2025-12-11

+19.6

O3

37.9

Ранг #46/63 · confidence 1 · дата оценки 2025-04-16

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникGPT-5.2

GPT-5.2

81.2

Ранг #40/106 · confidence 4 · дата оценки 2025-12-11

+6.9

O3

лидер

88.1

Ранг #24/106 · confidence 1 · дата оценки 2025-04-16

Знанияreported

AA-Omniscience Accuracy

ИсточникGPT-5.2

GPT-5.2

лидер

44.3

Ранг #27/106 · confidence 4 · дата оценки 2025-12-11

+5.7

O3

38.6

Ранг #40/106 · confidence 1 · дата оценки 2025-04-16

Знанияreported

AA-GPQA Diamond

ИсточникGPT-5.2

GPT-5.2

лидер

90.3

Ранг #32/113 · confidence 4 · дата оценки 2025-12-11

+7.6

O3

82.7

Ранг #71/113 · confidence 1 · дата оценки 2025-04-16

Знанияreported

AA-HLE

ИсточникGPT-5.2

GPT-5.2

лидер

37.7

Ранг #33/114 · confidence 4 · дата оценки 2025-12-11

+17.6

O3

20.1

Ранг #71/114 · confidence 1 · дата оценки 2025-04-16

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGPT-5.2

GPT-5.2

30.4

Ранг #47/117 · confidence 4 · дата оценки 2025-12-11

+0.7

O3

лидер

31.1

Ранг #45/117 · confidence 1 · дата оценки 2025-04-16

Мультимодальностьreported

Design Arena Website

ИсточникGPT-5.2

GPT-5.2

лидер

1209.0

Ранг #47/78 · confidence 4 · дата оценки 2025-12-11

+162.0

O3

1047.0

Ранг #71/78 · confidence 1 · дата оценки 2025-04-16

Следование инструкциямreported

AA-IFBench

ИсточникGPT-5.2

GPT-5.2

лидер

75.4

Ранг #18/84 · confidence 4 · дата оценки 2025-12-11

+4.0

O3

71.4

Ранг #30/84 · confidence 1 · дата оценки 2025-04-16

Агентыreported

τ²-bench results

ИсточникGPT-5.2

GPT-5.2

лидер

84.8

Ранг #46/82 · confidence 4 · дата оценки 2025-12-11

+4.1

O3

80.7

Ранг #54/82 · confidence 1 · дата оценки 2025-04-16

Сравнение аудитов API

Последние завершённые аудиты у общих поставщиков: четыре группы оценок безопасности и целостности со ссылками на отчёты.

Поставщик
GPT-5.2
O3
Завершённых аудитов у общих поставщиков пока нет.

Данные поставщиков

Замеры скорости и цены входных и выходных токенов для каждого поставщика помогают выбрать API и оценить стоимость перехода.

Поставщик
GPT-5.2
O3
N1N15 тестов

GPT-5.2

скорость / задержка

56 tok/s / 1798ms

ввод / вывод

Нет данных

O3

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

BUZZ5 тестов

GPT-5.2

скорость / задержка

64 tok/s / 3553ms

ввод / вывод

Нет данных

O3

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Rnglg2 API5 тестов

GPT-5.2

скорость / задержка

55 tok/s / 1434ms

ввод / вывод

Нет данных

O3

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

WSocket AI5 тестов

GPT-5.2

скорость / задержка

54 tok/s / 1449ms

ввод / вывод

Нет данных

O3

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

Yun API5 тестов

GPT-5.2

скорость / задержка

32 tok/s / 1965ms

ввод / вывод

Нет данных

O3

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.2

gpt-5.2-all

скорость / задержка

Нет данных

ввод / вывод

$0/request

O3

o3-2025-04-16

скорость / задержка

Нет данных

ввод / вывод

$0/request

GPT-5.2

gpt-5.2

скорость / задержка

Нет данных

ввод / вывод

$0.0068/request

O3

o3

скорость / задержка

Нет данных

ввод / вывод

$0.034/request

GPT-5.2

gpt-5.2-all

скорость / задержка

Нет данных

ввод / вывод

$0.0068/request

O3

o3-all

скорость / задержка

Нет данных

ввод / вывод

$0.055/request

GPT-5.2

gpt-5.2-all

скорость / задержка

Нет данных

ввод / вывод

$0.0068/request

O3

o3-all

скорость / задержка

Нет данных

ввод / вывод

$0.055/request

GPT-5.2

gpt-5.2-all

скорость / задержка

Нет данных

ввод / вывод

$0.010/request

O3

o3-all

скорость / задержка

Нет данных

ввод / вывод

$0.082/request

Частые вопросы

Взвешенный результат: GPT-5.2. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Почему это сравнение доступно в поиске?
В сравнении есть проверяемые показатели (6), а для обеих моделей доступны цены или результаты замеров.
Выдумываются ли недостающие показатели?
Нет. Показатели, для которых у LMSpeed нет данных, не включаются в отчёт.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.