Back to models

Model compare

GPT-5.1 vs GPT-5.6 Luna

Краткий вывод по GPT-5.1 и GPT-5.6 Luna перед подробной таблицей сравнения.

Key Takeaways

Взвешенный результат: GPT-5.6 Luna. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Вывод

GPT-5.6 Luna

GPT-5.6 Luna имеет более высокий взвешенный результат; баллы модели A / B — 12 к 88.

Глубина данных

111 точек данных

Включает 23 строк бенчмарков, 0 аудитов и 10 примеров провайдеров.

Сигнал выбора

Начать с GPT-5.6 Luna

Графики ниже разделяют 33 сильных сигналов по скорости, оценкам и состоянию аудита.

Изменить сравнение

Замените любую сторону отчёта, чтобы открыть новое сравнение в той же LMSpeed-структуре данных.

Выберите другую модель, чтобы открыть новый URL сравнения.

Таблица сравнения

This report only uses LMSpeed data for GPT-5.1 and GPT-5.6 Luna: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

Model compare
GPT-5.1
GPT-5.6 Luna
Overall leaderContenderLeading
Итоговый взвешенный балл12.0 балла88.0 балла
Лидерство в категориях benchmark0 категорий5 категорий
Операционные преимуществаFirst-token latency, Free providers, Provider coverageCheapest input price, Average speed
Контекстное окно400K токенов1.1M токенов
Макс. вывод128K токенов128K токенов
Модальности

Вход

ИзображениеТекстФайл

Выход

Текст

Вход

ФайлИзображениеТекст

Выход

Текст
Возможности
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning
Текст на входеИзображения на входеФайлы на входеТекст на выходеВызов инструментовСтруктурированный выводJSON-режимReasoning

В итоговом результате категории benchmark имеют вес 80%, а цена, скорость/задержка API и доступность — 20%. Количество недавних тестов не влияет на победителя, категории без общих данных исключаются.

Метаданные модели

Model compare
GPT-5.1
GPT-5.6 Luna
РазработчикOpenAIOpenAI
Выпущенанояб. 2025 г.июль 2026 г.
ПараметрыNo dataNo data
ТокенизаторGPTGPT
Срез знанийNo data2026-02-16
OpenRouter IDopenai/gpt-5.1openai/gpt-5.6-luna
СсылкиNo dataNo data

When to choose each model

This report only uses LMSpeed data for GPT-5.1 and GPT-5.6 Luna: pricing, speed aggregates, third-party benchmark scores, and shared provider samples.

GPT-5.1

Операционные преимущества GPT-5.1: First-token latency, Free providers, Provider coverage.

GPT-5.6 Luna

GPT-5.6 Luna сильнее в категориях benchmark (Агенты, Кодинг, Reasoning, Знания, Математика) и операционных измерениях (Cheapest input price, Average speed).

Benchmark score comparison

Third-party benchmark profile synced into LMSpeed; only metrics available for both models are shown.

Производительность по категориям

Сравнение категорий бенчмарков по шкале 0-100. Выберите категорию, чтобы посмотреть разрыв.

Покрытие модели A
6 / 8
Покрытие модели B
6 / 8
Общие
5 общих категорий

Средний балл

GPT-5.1

51.9

Средний балл

GPT-5.6 Luna

56.5

Агенты

GPT-5.6 Luna впереди на 10.6

GPT-5.147.7
GPT-5.6 Luna58.3

Кодинг

GPT-5.6 Luna впереди на 7.6

GPT-5.149.1
GPT-5.6 Luna56.7

Reasoning

GPT-5.6 Luna впереди на 0.5

GPT-5.154
GPT-5.6 Luna54.5

Знания

GPT-5.6 Luna впереди на 3.5

GPT-5.153
GPT-5.6 Luna56.5

Математика

GPT-5.6 Luna впереди на 8.4

GPT-5.154
GPT-5.6 Luna62.4

Многоязычность

Нет данных

GPT-5.1-
GPT-5.6 Luna-

Мультимодальность

GPT-5.6 Luna

GPT-5.1-
GPT-5.6 Luna50.3

Следование инструкциям

GPT-5.1

GPT-5.153.5
GPT-5.6 Luna-

Подробности профессиональных бенчмарков

Показатели на уровне метрик с источником, глубиной ранжирования, уверенностью, ошибкой и датой оценки, где они доступны.

Сводныеreported

BenchLM overall score

ИсточникGPT-5.1

GPT-5.1

56.0

Ранг #56/100 · confidence 1 · дата оценки 2025-11-13

+14.0

GPT-5.6 Luna

лидер

70.0

Ранг #19/100 · confidence 3 · дата оценки 2026-07-09

Ценыverified

Input price

ИсточникGPT-5.1 (high)

GPT-5.1

$1.25/M

Ранг #118/179 · confidence 4

+$1.05/M

GPT-5.6 Luna

лидер

$0.200/M

Ранг #32/179 · confidence 4

Ценыverified

Blended price

ИсточникGPT-5.1 (high)

GPT-5.1

$3.44/M

Ранг #134/179 · confidence 4

+$2.99/M

GPT-5.6 Luna

лидер

$0.450/M

Ранг #42/179 · confidence 4

Ценыverified

Output price

ИсточникGPT-5.1 (high)

GPT-5.1

$10.00/M

Ранг #137/179 · confidence 4

+$8.80/M

GPT-5.6 Luna

лидер

$1.20/M

Ранг #48/179 · confidence 4

Reasoningreported

CritPt

ИсточникGPT-5.1

GPT-5.1

4.9

Ранг #43/83 · confidence 1 · дата оценки 2025-11-13

+15.7

GPT-5.6 Luna

лидер

20.6

Ранг #12/83 · confidence 3 · дата оценки 2026-07-09

Reasoningreported

AA-LCR

ИсточникGPT-5.1

GPT-5.1

76.7

Ранг #19/100 · confidence 1 · дата оценки 2025-11-13

+1.6

GPT-5.6 Luna

лидер

78.3

Ранг #13/100 · confidence 3 · дата оценки 2026-07-09

Reasoningverified

GPQA

ИсточникGPT-5.1 (high)

GPT-5.1

87.3%

Ранг #47/211 · confidence 4

+3.8%

GPT-5.6 Luna

лидер

91.1%

Ранг #21/211 · confidence 4

Reasoningverified

HLE

ИсточникGPT-5.1 (high)

GPT-5.1

28.5%

Ранг #55/208 · confidence 4

+11.0%

GPT-5.6 Luna

лидер

39.5%

Ранг #27/208 · confidence 4

Кодингreported

AA Coding Index

ИсточникGPT-5.1

GPT-5.1

49.4

Ранг #42/70 · confidence 1 · дата оценки 2025-11-13

+22.1

GPT-5.6 Luna

лидер

71.5

Ранг #15/70 · confidence 3 · дата оценки 2026-07-09

Кодингverified

SciCode

ИсточникGPT-5.1 (high)

GPT-5.1

43.3%

Ранг #55/204 · confidence 4

+9.2%

GPT-5.6 Luna

лидер

52.5%

Ранг #21/204 · confidence 4

Кодингreported

AA-SciCode

ИсточникGPT-5.1

GPT-5.1

43.3

Ранг #55/108 · confidence 1 · дата оценки 2025-11-13

+9.2

GPT-5.6 Luna

лидер

52.5

Ранг #24/108 · confidence 3 · дата оценки 2026-07-09

Математикаreported

BenchLM Math score

ИсточникGPT-5.1

GPT-5.1

49.7

Ранг #36/62 · confidence 1 · дата оценки 2025-11-13

+47.2

GPT-5.6 Luna

лидер

96.9

Ранг #1/62 · confidence 3 · дата оценки 2026-07-09

Математикаreported

FrontierMath v2 (Tier 4)

ИсточникGPT-5.1

GPT-5.1

12.5

Ранг #16/35 · confidence 1 · дата оценки 2025-11-13

+46.0

GPT-5.6 Luna

лидер

58.5

Ранг #3/35 · confidence 3 · дата оценки 2026-07-09

Математикаreported

FrontierMath v2 (Tiers 1-3)

ИсточникGPT-5.1

GPT-5.1

31.0

Ранг #19/47 · confidence 1 · дата оценки 2025-11-13

+47.6

GPT-5.6 Luna

лидер

78.6

Ранг #3/47 · confidence 3 · дата оценки 2026-07-09

Знанияreported

AA-Omniscience Hallucination Rate

ИсточникGPT-5.1

GPT-5.1

51.9

Ранг #72/101 · confidence 1 · дата оценки 2025-11-13

+40.7

GPT-5.6 Luna

лидер

92.6

Ранг #10/101 · confidence 3 · дата оценки 2026-07-09

Знанияreported

AA-GPQA Diamond

ИсточникGPT-5.1

GPT-5.1

87.3

Ранг #44/108 · confidence 1 · дата оценки 2025-11-13

+3.8

GPT-5.6 Luna

лидер

91.1

Ранг #21/108 · confidence 3 · дата оценки 2026-07-09

Знанияreported

Artificial Analysis Intelligence Index

ИсточникGPT-5.1

GPT-5.1

37.5

Ранг #52/111 · confidence 1 · дата оценки 2025-11-13

+13.8

GPT-5.6 Luna

лидер

51.2

Ранг #21/111 · confidence 3 · дата оценки 2026-07-09

Знанияreported

AA-HLE

ИсточникGPT-5.1

GPT-5.1

28.5

Ранг #47/108 · confidence 1 · дата оценки 2025-11-13

+11.0

GPT-5.6 Luna

лидер

39.5

Ранг #25/108 · confidence 3 · дата оценки 2026-07-09

Знанияreported

AA-Omniscience Accuracy

ИсточникGPT-5.1

GPT-5.1

37.7

Ранг #39/101 · confidence 1 · дата оценки 2025-11-13

+5.0

GPT-5.6 Luna

лидер

42.7

Ранг #25/101 · confidence 3 · дата оценки 2026-07-09

Мультимодальностьreported

AA-MMMU-Pro

ИсточникGPT-5.1

GPT-5.1

75.5

Ранг #28/65 · confidence 1 · дата оценки 2025-11-13

+3.1

GPT-5.6 Luna

лидер

78.6

Ранг #17/65 · confidence 3 · дата оценки 2026-07-09

Агентыreported

GDPval-AA

ИсточникGPT-5.1

GPT-5.1

24.6

Ранг #46/61 · confidence 1 · дата оценки 2025-11-13

+29.3

GPT-5.6 Luna

лидер

53.9

Ранг #11/61 · confidence 3 · дата оценки 2026-07-09

Агентыreported

GDPval-AA

ИсточникGPT-5.1

GPT-5.1

993.0

Ранг #46/66 · confidence 1 · дата оценки 2025-11-13

+589.0

GPT-5.6 Luna

лидер

1582.0

Ранг #11/66 · confidence 3 · дата оценки 2026-07-09

Агентыreported

AA Agentic Index

ИсточникGPT-5.1

GPT-5.1

21.6

Ранг #47/65 · confidence 1 · дата оценки 2025-11-13

+25.3

GPT-5.6 Luna

лидер

46.9

Ранг #15/65 · confidence 3 · дата оценки 2026-07-09

API audit comparison

Latest completed audits from shared providers, with four safety and integrity score groups plus report links.

Provider
GPT-5.1
GPT-5.6 Luna
No completed audits are available from shared providers yet.

Provider examples

Speed aggregates and input/output pricing share each provider row for real API selection and migration cost checks.

Provider
GPT-5.1
GPT-5.6 Luna
BUZZ10 tests

GPT-5.1

speed / latency

137 tok/s / 3299ms

input / output

No data

GPT-5.6 Luna

speed / latency

N/A / N/A

input / output

No data

OpenCode10 tests

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

GPT-5.6 Luna

speed / latency

2042 tok/s / 2791ms

input / output

No data

N1N5 tests

GPT-5.1

speed / latency

96 tok/s / 1862ms

input / output

No data

GPT-5.6 Luna

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

152 tok/s / 936ms

input / output

No data

GPT-5.6 Luna

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

speed / latency

N/A / N/A

input / output

No data

GPT-5.6 Luna

speed / latency

N/A / N/A

input / output

No data

GPT-5.1

gpt-5.1-2025-11-13

speed / latency

No data

input / output

$0.959/M/$7.67/M

GPT-5.6 Luna

gpt-5.6-luna

speed / latency

No data

input / output

$0/M/$0/M

GPT-5.1

gpt-5.1-chat-latest

speed / latency

No data

input / output

$0/request

GPT-5.6 Luna

gpt-5.6-luna

speed / latency

No data

input / output

$0/request

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0027/request

GPT-5.6 Luna

gpt-5.6-luna

speed / latency

No data

input / output

$0.034/M/$0.205/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.0068/request

GPT-5.6 Luna

gpt-5.6-luna

speed / latency

No data

input / output

$0.014/M/$0.082/M

GPT-5.1

gpt-5.1

speed / latency

No data

input / output

$0.103/M/$0.822/M

GPT-5.6 Luna

gpt-5.6-luna

speed / latency

No data

input / output

$0.010/M/$0.062/M

FAQ

Взвешенный результат: GPT-5.6 Luna. Категории benchmark дают 80%, а цена, производительность API и доступность — 20%.

Why is this comparison indexable?
It has 6 verifiable comparison points, and both models have pricing or benchmark data.
Are missing metrics invented?
No. Metrics without LMSpeed data are omitted from this report.

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.