Вернуться к моделям

Сравнение моделей

Gemini 3.1 Pro vs GPT-5.4

Краткий вывод по Gemini 3.1 Pro и GPT-5.4 перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.4

GPT-5.4 имеет более высокий взвешенный результат; баллы модели A / B — 38.3 к 61.7.

Глубина данных

160 точек данных

Включает 48 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.4

Графики ниже разделяют 58 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

Отчёт использует данные LMSpeed о Gemini 3.1 Pro и GPT-5.4: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Сравнение моделей
Gemini 3.1 Pro
GPT-5.4
Общий лидерСоперникЛидирует
Итоговый взвешенный балл38.3 балла61.7 балла
Лидерство в категориях benchmark3 категорий4 категорий
Операционные преимуществаСредняя скоростьМинимальная цена ввода, Задержка первого токена, Бесплатные поставщики, Набор поставщиков
Контекстное окно1.0M токенов1.1M токенов
Макс. вывод65.5K токенов128K токенов
Модальности

Вход

АудиоФайлИзображениеТекстvideo

Выход

Текст

Вход

ТекстИзображениеФайл

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеАудио на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Сравнение моделей
Gemini 3.1 Pro
GPT-5.4
РазработчикGoogleOpenAI
Выпущенафевр. 2026 г.март 2026 г.
ПараметрыНет данныхНет данных
ТокенизаторGeminiGPT
Срез знанийНет данныхНет данных
OpenRouter IDgoogle/gemini-3.1-pro-previewopenai/gpt-5.4
СсылкиНет данныхНет данных

Когда выбирать каждую модель

Отчёт использует данные LMSpeed о Gemini 3.1 Pro и GPT-5.4: цены, замеры скорости, независимые тесты и примеры общих поставщиков.

Gemini 3.1 Pro

Gemini 3.1 Pro сильнее в категориях benchmark (Reasoning, Мультимодальность, Следование инструкциям) и операционных измерениях (Средняя скорость).

GPT-5.4

GPT-5.4 сильнее в категориях benchmark (Агенты, Кодинг, Знания, Математика) и операционных измерениях (Минимальная цена ввода, Задержка первого токена, Бесплатные поставщики, Набор поставщиков).

Сравнение результатов тестов

Независимые тесты, собранные LMSpeed. Показаны только показатели, доступные для обеих моделей.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
8 / 8
Покрытие модели B
7 / 8
Общие
7 общих категорий

Средний балл

Gemini 3.1 Pro

57

Средний балл

GPT-5.4

56.6

Агенты

GPT-5.4 впереди на 6.1

Gemini 3.1 Pro50.2
GPT-5.456.3

Кодинг

GPT-5.4 впереди на 5.0

Gemini 3.1 Pro57.2
GPT-5.462.2

Reasoning

Gemini 3.1 Pro впереди на 1.7

Gemini 3.1 Pro57.4
GPT-5.455.7

Знания

GPT-5.4 впереди на 1.5

Gemini 3.1 Pro57
GPT-5.458.5

Математика

GPT-5.4 впереди на 2.2

Gemini 3.1 Pro54.6
GPT-5.456.8

Многоязычность

Gemini 3.1 Pro

Gemini 3.1 Pro69.3
GPT-5.4-

Мультимодальность

Gemini 3.1 Pro впереди на 2.6

Gemini 3.1 Pro55.1
GPT-5.452.5

Следование инструкциям

Gemini 3.1 Pro впереди на 1.3

Gemini 3.1 Pro55.3
GPT-5.454

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

67.0

Ранг #27/112 · confidence 3 · дата оценки 2026-02-19

+4.0

GPT-5.4

63.0

Ранг #41/112 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

ARC-AGI-3

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

0.4

Ранг #7/12 · confidence 3 · дата оценки 2026-02-19

+0.2

GPT-5.4

0.2

Ранг #9/12 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

ARC-AGI-2

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

77.1

Ранг #8/19 · confidence 3 · дата оценки 2026-02-19

+3.1

GPT-5.4

74.0

Ранг #10/19 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

CritPt

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

17.7

Ранг #19/88 · confidence 3 · дата оценки 2026-02-19

+5.7

GPT-5.4

лидер

23.4

Ранг #11/88 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

AA-LCR

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

82.0

Ранг #14/106 · confidence 3 · дата оценки 2026-02-19

0.0

GPT-5.4

82.0

Ранг #14/106 · confidence 4 · дата оценки 2026-03-05

Reasoningreported

BenchLM Reasoning score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

50.6

Ранг #60/67 · confidence 3 · дата оценки 2026-02-19

+6.6

GPT-5.4

лидер

57.2

Ранг #51/67 · confidence 4 · дата оценки 2026-03-05

Кодингreported

LiveCodeBench Pro

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

82.9

Ранг #2/4 · confidence 3 · дата оценки 2026-02-19

+4.6

GPT-5.4

лидер

87.5

Ранг #1/4 · confidence 4 · дата оценки 2026-03-05

Кодингreported

React Native Evals

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

78.9

Ранг #6/12 · confidence 3 · дата оценки 2026-02-19

+6.4

GPT-5.4

лидер

85.3

Ранг #1/12 · confidence 4 · дата оценки 2026-03-05

Кодингreported

Vibe Code Bench

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

32.0

Ранг #13/33 · confidence 3 · дата оценки 2026-02-19

+35.4

GPT-5.4

лидер

67.4

Ранг #3/33 · confidence 4 · дата оценки 2026-03-05

Кодингreported

EEBench

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

46.3

Ранг #5/25 · confidence 3 · дата оценки 2026-02-19

+7.8

GPT-5.4

38.5

Ранг #9/25 · confidence 3 · дата оценки 2026-03-05

Кодингreported

AA-SciCode

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

58.7

Ранг #6/113 · confidence 3 · дата оценки 2026-02-19

+2.1

GPT-5.4

56.6

Ранг #10/113 · confidence 4 · дата оценки 2026-03-05

Кодингreported

BenchLM Coding score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

74.3

Ранг #7/87 · confidence 3 · дата оценки 2026-02-19

+31.5

GPT-5.4

42.8

Ранг #69/87 · confidence 4 · дата оценки 2026-03-05

Кодингreported

AA Coding Index

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

68.8

Ранг #25/75 · confidence 3 · дата оценки 2026-02-19

+2.2

GPT-5.4

лидер

71.0

Ранг #21/75 · confidence 4 · дата оценки 2026-03-05

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

36.9

Ранг #15/47 · confidence 3 · дата оценки 2026-02-19

+10.7

GPT-5.4

лидер

47.6

Ранг #7/47 · confidence 4 · дата оценки 2026-03-05

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

16.7

Ранг #14/36 · confidence 3 · дата оценки 2026-02-19

+10.4

GPT-5.4

лидер

27.1

Ранг #9/36 · confidence 4 · дата оценки 2026-03-05

Математикаreported

BenchLM Math score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

54.3

Ранг #35/63 · confidence 3 · дата оценки 2026-02-19

+10.2

GPT-5.4

лидер

64.5

Ранг #24/63 · confidence 4 · дата оценки 2026-03-05

Знанияreported

HealthBench Hard

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

20.6

Ранг #6/8 · confidence 3 · дата оценки 2026-02-19

+19.5

GPT-5.4

лидер

40.1

Ранг #1/8 · confidence 4 · дата оценки 2026-03-05

Знанияreported

MedXpertQA (Text)

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

71.5

Ранг #1/4 · confidence 3 · дата оценки 2026-02-19

+11.9

GPT-5.4

59.6

Ранг #2/4 · confidence 4 · дата оценки 2026-03-05

Знанияreported

GPQA-D

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

94.3

Ранг #3/32 · confidence 3 · дата оценки 2026-02-19

+1.5

GPT-5.4

92.8

Ранг #9/32 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-GPQA Diamond

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

94.1

Ранг #5/113 · confidence 3 · дата оценки 2026-02-19

+2.1

GPT-5.4

92.0

Ранг #21/113 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Index

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

31.9

Ранг #5/45 · confidence 3 · дата оценки 2026-02-19

+26.1

GPT-5.4

5.8

Ранг #28/45 · confidence 4 · дата оценки 2026-03-05

Знанияreported

HLE w/o tools

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

45.4

Ранг #6/22 · confidence 3 · дата оценки 2026-02-19

+5.6

GPT-5.4

39.8

Ранг #15/22 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Accuracy

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

54.9

Ранг #9/106 · confidence 3 · дата оценки 2026-02-19

+4.1

GPT-5.4

50.8

Ранг #15/106 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-HLE

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

47.0

Ранг #10/114 · confidence 3 · дата оценки 2026-02-19

+3.3

GPT-5.4

43.7

Ранг #15/114 · confidence 4 · дата оценки 2026-03-05

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

50.9

Ранг #76/106 · confidence 3 · дата оценки 2026-02-19

+40.8

GPT-5.4

лидер

91.7

Ранг #13/106 · confidence 4 · дата оценки 2026-03-05

Знанияreported

BenchLM Knowledge score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

79.2

Ранг #20/83 · confidence 3 · дата оценки 2026-02-19

+4.9

GPT-5.4

74.3

Ранг #30/83 · confidence 4 · дата оценки 2026-03-05

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

30.4

Ранг #48/117 · confidence 3 · дата оценки 2026-02-19

+8.6

GPT-5.4

лидер

39.0

Ранг #29/117 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

MedXpertQA (MM)

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

81.3

Ранг #1/6 · confidence 3 · дата оценки 2026-02-19

+4.2

GPT-5.4

77.1

Ранг #3/6 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

ZeroBench

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

29.0

Ранг #2/4 · confidence 3 · дата оценки 2026-02-19

+12.0

GPT-5.4

лидер

41.0

Ранг #1/4 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

MMMU-Pro

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

83.9

Ранг #2/31 · confidence 3 · дата оценки 2026-02-19

+2.7

GPT-5.4

81.2

Ранг #7/31 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

ERQA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

69.4

Ранг #3/8 · confidence 3 · дата оценки 2026-02-19

+4.0

GPT-5.4

65.4

Ранг #5/8 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

ScreenSpot Pro

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

84.4

Ранг #5/12 · confidence 3 · дата оценки 2026-02-19

+1.0

GPT-5.4

лидер

85.4

Ранг #3/12 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

SimpleVQA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

72.4

Ранг #4/8 · confidence 3 · дата оценки 2026-02-19

+11.3

GPT-5.4

61.1

Ранг #5/8 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

AA-MMMU-Pro

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

82.4

Ранг #8/68 · confidence 3 · дата оценки 2026-02-19

+4.0

GPT-5.4

78.4

Ранг #23/68 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

CharXiv

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

80.2

Ранг #21/30 · confidence 3 · дата оценки 2026-02-19

+2.6

GPT-5.4

лидер

82.8

Ранг #12/30 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

BenchLM Multimodal Grounded score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

79.2

Ранг #14/56 · confidence 3 · дата оценки 2026-02-19

+9.9

GPT-5.4

69.3

Ранг #28/56 · confidence 4 · дата оценки 2026-03-05

Мультимодальностьreported

Design Arena Website

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

1265.0

Ранг #32/78 · confidence 3 · дата оценки 2026-02-19

+33.0

GPT-5.4

1232.0

Ранг #42/78 · confidence 4 · дата оценки 2026-03-05

Следование инструкциямreported

AA-IFBench

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

77.1

Ранг #7/84 · confidence 3 · дата оценки 2026-02-19

+3.2

GPT-5.4

73.9

Ранг #21/84 · confidence 4 · дата оценки 2026-03-05

Агентыreported

τ²-bench results

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

95.6

Ранг #17/82 · confidence 3 · дата оценки 2026-02-19

+3.3

GPT-5.4

лидер

98.9

Ранг #2/82 · confidence 4 · дата оценки 2026-03-05

Агентыreported

Gert Labs

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

56.9

Ранг #14/49 · confidence 3 · дата оценки 2026-02-19

+8.0

GPT-5.4

лидер

64.9

Ранг #4/49 · confidence 4 · дата оценки 2026-03-05

Агентыreported

APEX-Agents-AA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

32.0

Ранг #9/23 · confidence 3 · дата оценки 2026-02-19

+1.3

GPT-5.4

лидер

33.3

Ранг #7/23 · confidence 4 · дата оценки 2026-03-05

Агентыreported

DeepSearchQA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

69.7

Ранг #13/14 · confidence 3 · дата оценки 2026-02-19

+3.9

GPT-5.4

лидер

73.6

Ранг #12/14 · confidence 4 · дата оценки 2026-03-05

Агентыreported

Claw-Eval

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

57.8

Ранг #16/27 · confidence 3 · дата оценки 2026-02-19

+2.5

GPT-5.4

лидер

60.3

Ранг #13/27 · confidence 4 · дата оценки 2026-03-05

Агентыreported

ResearchClawBench

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

13.3

Ранг #17/18 · confidence 3 · дата оценки 2026-02-19

+2.0

GPT-5.4

лидер

15.3

Ранг #13/18 · confidence 4 · дата оценки 2026-03-05

Агентыreported

AA Agentic Index

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

10.3

Ранг #55/70 · confidence 3 · дата оценки 2026-02-19

+33.9

GPT-5.4

лидер

44.2

Ранг #14/70 · confidence 4 · дата оценки 2026-03-05

Агентыreported

GDPval-AA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

20.2

Ранг #54/66 · confidence 3 · дата оценки 2026-02-19

+20.1

GPT-5.4

лидер

40.3

Ранг #26/66 · confidence 4 · дата оценки 2026-03-05

Агентыreported

GDPval-AA

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

904.0

Ранг #55/72 · confidence 3 · дата оценки 2026-02-19

+403.0

GPT-5.4

лидер

1307.0

Ранг #26/72 · confidence 4 · дата оценки 2026-03-05

Агентыreported

BenchLM Agentic score

ИсточникGemini 3.1 Pro

Gemini 3.1 Pro

лидер

72.8

Ранг #28/77 · confidence 3 · дата оценки 2026-02-19

+0.8

GPT-5.4

72.0

Ранг #29/77 · confidence 4 · дата оценки 2026-03-05

Сравнение аудитов API

Последние завершённые аудиты у общих поставщиков: четыре группы оценок безопасности и целостности со ссылками на отчёты.

Поставщик
Gemini 3.1 Pro
GPT-5.4
Завершённых аудитов у общих поставщиков пока нет.

Данные поставщиков

Замеры скорости и цены входных и выходных токенов для каждого поставщика помогают выбрать API и оценить стоимость перехода.

Поставщик
Gemini 3.1 Pro
GPT-5.4
天宫造物50 тестов

Gemini 3.1 Pro

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

50 tok/s / 7305ms

ввод / вывод

Нет данных

星见雅 API20 тестов

Gemini 3.1 Pro

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

49 tok/s / 5435ms

ввод / вывод

Нет данных

6345ywz API15 тестов

Gemini 3.1 Pro

скорость / задержка

N/A / N/A

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

41 tok/s / 6581ms

ввод / вывод

Нет данных

TradingBase API15 тестов

Gemini 3.1 Pro

скорость / задержка

102 tok/s / 12933ms

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

71 tok/s / 1629ms

ввод / вывод

Нет данных

小水管 API15 тестов

Gemini 3.1 Pro

скорость / задержка

101 tok/s / 15025ms

ввод / вывод

Нет данных

GPT-5.4

скорость / задержка

44 tok/s / 2518ms

ввод / вывод

Нет данных

Gemini 3.1 Pro

gemini-3.1-pro-high

скорость / задержка

Нет данных

ввод / вывод

$0.700/M/$4.20/M

GPT-5.4

gpt-5.4-2026-03-05

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Gemini 3.1 Pro

gemini-3.1-pro-preview

скорость / задержка

Нет данных

ввод / вывод

$1.53/M/$9.21/M

GPT-5.4

gpt-5.4

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Gemini 3.1 Pro

gemini-3.1-pro

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

GPT-5.4

gpt-5.4

скорость / задержка

Нет данных

ввод / вывод

$0/M/$0/M

Gemini 3.1 Pro

gemini-3.1-pro-preview

скорость / задержка

Нет данных

ввод / вывод

$0/request

GPT-5.4

gpt-5.4-openai-compact

скорость / задержка

Нет данных

ввод / вывод

$0/request

Gemini 3.1 Pro

gemini-3.1-pro-preview

скорость / задержка

Нет данных

ввод / вывод

$0.0052/request

GPT-5.4

gpt-5.4

скорость / задержка

Нет данных

ввод / вывод

$0.014/request

Частые вопросы

Взвешенный результат: GPT-5.4. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Почему это сравнение доступно в поиске?
В сравнении есть проверяемые показатели (6), а для обеих моделей доступны цены или результаты замеров.
Выдумываются ли недостающие показатели?
Нет. Показатели, для которых у LMSpeed нет данных, не включаются в отчёт.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.