OpenAI
·Released on 13 нояб. 2025 г.

GPT-5.1 API Benchmarks, Pricing & Provider Data

Compare GPT-5.1 with another model

Choose a model to open its comparison page.

Share on X
LLM

Тесты, цены API и данные поставщиков GPT-5.1: поставщиков — 1462, цены от $0.0027/request. Бесплатный API GPT-5.1 предлагают поставщики: 8. На странице также приведены измеренная скорость API и задержка первого токена.

OpenAI GPT-5.1 is a GPT-5 series model focused on improved reasoning depth, tool use, and reliable long-form generation for production AI applications.

Качество
#32of 111
66.0
Оценка LMSpeed
Скорость
142char/s
2.78 s
Стоимость
#123of 186
$0.0027/ 1M · 8:1 in:out
$0.0004 in · $0.0023 out

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
7 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты47.3Программирование49.6Рассуждение53.8Знания51.4Математика53.4Многоязычность-Мультимодальность48.8Следование инструкциям53.6
#1Рассуждение53.8РейтинговаяОбщий рейтинг #243/4 Измеренные измерения
80% интервал: 45.262.5
abstract logicТолько априорное
scientific causal47
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints58.4
mmlu_pro · mmlu_pro
evidence verification56
lcr · lcr
#2Следование инструкциям53.6Предварительная1/4 Измеренные измерения
80% интервал: 37.669.6
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization53.6
ifbench · aa_if_bench
long multiturn instructionТолько априорное
#3Математика53.4Предварительная1/4 Измеренные измерения
80% интервал: 37.369.4
foundational mathТолько априорное
competition mathТолько априорное
proof frontier53.4
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool mathТолько априорное
#4Знания51.4Предварительная1/4 Измеренные измерения
80% интервал: 37.465.4
broad knowledge51.4
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#5Программирование49.6Оценка2/4 Измеренные измерения
80% интервал: 38.460.7
code generation49.5
livecodebench · livecodebench / scicode · aa_sci_code
repository engineering49.7
vibecode · vibe_code_bench
debugging testingТолько априорное
tooling qualityТолько априорное
#6Мультимодальность48.8Предварительная1/4 Измеренные измерения
80% интервал: 32.465.1
perception ocrТолько априорное
document spatialТолько априорное
visual reasoning48.8
benchlm_category_multimodal · benchlm_category_multimodal_grounded
video actionТолько априорное
#7Агенты47.3Оценка3/4 Измеренные измерения
80% интервал: 38.156.6
planning46
deep_planning · gert_labs
tool use49.5
tau · tau2_bench
environment execution46.6
gdpval_aa · benchlm_agentic_gdpval_aa
recovery reliabilityТолько априорное
Нет данных:Многоязычность

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
400Ktokens
480 pages of text
OUTPUT
128Ktokens
8K128K1M4M
400K

Возможности

Technical Details

Вход
Выход
Выпущена
Nov 2025
Документация
Токенизатор
GPT
Архитектура
text+image+file->text
Модерация
Да
Поддерживаемые параметры
include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools

Rankings

Excels at

It's decent at

Falls behind in

Подробные оценки

Обновлено: 11 сент. 2026 г.

Общее

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Overall score66.0#32 / 111
Overall score
Рейтинг LMSpeed#32
Оценка66.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$1.25/M#123 / 186Цена выходных данных$10.00/M#142 / 186
Цена входных данных
Input price
Рейтинг LMSpeed#123
Оценка$1.25/M
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#142
Оценка$10.00/M
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка47.380% интервал38.1–56.63/4 Измеренные измеренияAA Agentic Index21.6#45 / 70Τ²-bench results81.9#53 / 82
Измерения и доказательства
Планирование и декомпозиция46
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
deep_planning · gert_labs · z -0.52 · q 1.00
Использование инструментов49.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
tau · tau2_bench · z -0.17 · q 1.00
Среда и длительное выполнение46.6
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.59 · q 1.00
Восстановление и надёжность завершенияТолько априорное
AA Agentic Index
Рейтинг LMSpeed#45
Оценка21.6
Источникbenchlm.ai
Обновлено8 сент. 2026 г.
Достоверность3
Τ²-bench resultsДоказательство V3
Рейтинг LMSpeed#53
Оценка81.9
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Gert LabsДоказательство V3
Рейтинг LMSpeed#34
Оценка41.2
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
GDPval-AA
Рейтинг LMSpeed#52
Оценка21.5
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
GDPval-AAДоказательство V3
Рейтинг LMSpeed#53
Оценка930.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка49.680% интервал38.4–60.72/4 Измеренные измеренияLiveCodeBench86.8%#4 / 115AA-SciCode43.3#60 / 113
Измерения и доказательства
Генерация кода49.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
livecodebench · livecodebench · z 0.03 · q 1.00
scicode · aa_sci_code · z 0.00 · q 1.00
Работа с репозиториями49.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
vibecode · vibe_code_bench · z -0.02 · q 1.00
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#4
Оценка86.8%
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#60
Оценка43.3
Источникbenchlm.ai
Обновлено8 сент. 2026 г.
Достоверность3
Vibe Code BenchДоказательство V3
Рейтинг LMSpeed#18
Оценка24.6
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA Coding Index
Рейтинг LMSpeed#47
Оценка49.4
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка53.8#2480% интервал45.2–62.53/4 Измеренные измеренияMMLU-Pro80.1%#62 / 129GPQA87.3%#52 / 218
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение47
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z 0.18 · q 1.00
gpqa · gpqa · z -0.63 · q 1.00
hle · hle · z -0.73 · q 1.00
Многошаговые ограничения58.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z 0.92 · q 1.00
Интеграция и проверка свидетельств56
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z 0.45 · q 1.00
MMLU-ProДоказательство V3
Рейтинг LMSpeed#62
Оценка80.1%
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4
GPQAДоказательство V3
Рейтинг LMSpeed#52
Оценка87.3%
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#61
Оценка28.5%
Источникartificialanalysis.ai
Обновлено11 сент. 2026 г.
Достоверность4
AA-LCRДоказательство V3
Рейтинг LMSpeed#24
Оценка80.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
CritPtДоказательство V3
Рейтинг LMSpeed#48
Оценка4.9
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Reasoning score
Рейтинг LMSpeed#17
Оценка76.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка51.480% интервал37.4–65.41/4 Измеренные измеренияArtificial Analysis Intelligence Index24.7#67 / 117AA-GPQA Diamond87.3#48 / 113
Измерения и доказательства
Широкие знания51.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · aa_omniscience_index · z 0.30 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z -0.36 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#67
Оценка24.7
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA-GPQA Diamond
Рейтинг LMSpeed#48
Оценка87.3
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA-HLE
Рейтинг LMSpeed#52
Оценка28.5
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA-Omniscience IndexДоказательство V3
Рейтинг LMSpeed#29
Оценка5.4
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA-Omniscience Accuracy
Рейтинг LMSpeed#43
Оценка37.7
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#74
Оценка51.9
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Knowledge scoreДоказательство V3
Рейтинг LMSpeed#55
Оценка63.6
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка53.480% интервал37.3–69.41/4 Измеренные измеренияMath score49.2#37 / 63FrontierMath v2 (Tiers 1-3)31.0#19 / 47
Измерения и доказательства
Базовая математикаТолько априорное
Олимпиадная математикаТолько априорное
Продвинутые доказательства53.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
frontiermath · frontier_math_v2_tier4 · z 0.40 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.21 · q 1.00
Прикладная математика и инструментыТолько априорное
Math score
Рейтинг LMSpeed#37
Оценка49.2
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
FrontierMath v2 (Tiers 1-3)Доказательство V3
Рейтинг LMSpeed#19
Оценка31.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
FrontierMath v2 (Tier 4)Доказательство V3
Рейтинг LMSpeed#17
Оценка12.5
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка48.880% интервал32.4–65.11/4 Измеренные измеренияAA-MMMU-Pro75.5#30 / 68Design Arena Website1201.0#50 / 78
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждение48.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
benchlm_category_multimodal · benchlm_category_multimodal_grounded · z 0.12 · q 1.00
Видео и действия в средеТолько априорное
AA-MMMU-Pro
Рейтинг LMSpeed#30
Оценка75.5
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Design Arena Website
Рейтинг LMSpeed#50
Оценка1201.0
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Multimodal Grounded scoreДоказательство V3
Рейтинг LMSpeed#25
Оценка71.2
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка53.680% интервал37.6–69.61/4 Измеренные измеренияAA-IFBench72.9#26 / 84Instruction Following score89.3#20 / 52
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций53.6
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z 0.19 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#26
Оценка72.9
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2
Instruction Following score
Рейтинг LMSpeed#20
Оценка89.3
Источникbenchlm.ai
Обновлено10 сент. 2026 г.
Достоверность2

Эндпоинты OpenRouter

5 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
OpenAI
openai/flex
$0.625/M$5/M100%undefined токенов / undefined токенов
Azure
azure
$1.25/M$10/M100%undefined токенов / undefined токенов
OpenAI
openai
$1.25/M$10/M100.0%undefined токенов / undefined токенов
Azure
azure/swedencentral
$1.38/M$11/Mundefined токенов / undefined токенов
OpenAI
openai/fast
$2.50/M$20/Mundefined токенов / undefined токенов

Сравнение цен

Compare GPT-5.1 API pricing across 1454 providers. Prices range from $0.0027/request to $495.00/M. Yun API offers the lowest rate at $0.0027/request. 8 providers offer free API credits or a free tier.

ПровайдерРаботоспособностьВариант моделиГруппаВходные данные ($/M)Выходные данные ($/M)Скорость (т/с)Первый токенАудит
L1
100%
gpt-5.1
default
-86%$0.171/M
Cache read$0.017/M
-86%$1.37/M
95.9 t/s
1.86 s
L1
100%
gpt-5.1-chat
default
-86%$0.171/M
Cache read$0.017/M
-86%$1.37/M
L1
100%
gpt-5.1-chat-latest
default
-86%$0.171/M
Cache read$0.017/M
-86%$1.37/M
L1
100%
gpt-5.1-2025-11-13
default
-86%$0.171/M
Cache read$0.017/M
-86%$1.37/M
L1
100%
gpt-5.1-2025-11-13
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1-chat-latest
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1-chat
default
-93%$0.086/M
Cache read$0.0086/M
-93%$0.685/M
L1
100%
gpt-5.1
default
$1.25/M
$10.00/M
L1
100%
gpt-5.1-2025-11-13
default
$1.25/M
$10.00/M
L1
100%
gpt-5.1-all
default
$1.25/M
$10.00/M
L1
100%
gpt-5.1
default
$0.014/request
-
L1
100%
gpt-5.1-high
CodeX_05_token
$0.0068/request
-
L1
100%
gpt-5.1-2025-11-13
default
-86%$0.171/M
-86%$1.37/M
L1
100%
gpt-5.1-chat
default
-86%$0.171/M
-86%$1.37/M
L1
100%
gpt-5.1-chat-2025-11-13
default
-86%$0.171/M
-86%$1.37/M
L1
100%
gpt-5.1-chat-latest
default
-86%$0.171/M
-86%$1.37/M
L1
100%
gpt-5.1-low
CodeX_05_token
-93%$0.086/M
-93%$0.685/M
L1
100%
gpt-5.1-medium
CodeX_05_token
-93%$0.086/M
-93%$0.685/M
L1
100%
gpt-5.1-all
default
-86%$0.171/M
-86%$1.37/M
Показано 20 ID моделей из 206.

Альтернативы и похожие модели

Frequently Asked Questions

What benchmark data does GPT-5.1 include?
LMSpeed shows GPT-5.1 benchmark context, API price, output speed, first-token latency, and provider data across 1462 providers when those signals are available.
Сколько стоит API GPT-5.1?
Цены GPT-5.1 у поставщиков (1462): от $0.0027/request до $495.00/M. Самая низкая указанная цена — у Yun API.
What does the GPT-5.1 API pricing table include?
The GPT-5.1 API pricing table compares 1462 providers by input price, output price, free tier status, speed, first-token latency, and recent health data when available.
У какого провайдера самая низкая цена API GPT-5.1?
Сейчас самая низкая указанная цена GPT-5.1 — $0.0027/request у Yun API. Сравниваются поставщики: 1462.
Can I compare GPT-5.1 API price and speed together?
Yes. LMSpeed shows GPT-5.1 API price, output speed, first-token latency, and provider health on the same page so you can compare cost and performance together.
Является ли API GPT-5.1 бесплатным?
Да, GPT-5.1 доступна бесплатно через 8 API-провайдерundefined other undefined} на LMSpeed, включая 兔子API, 兔子API, 兔子API, 兔子API, 初叶🍂Furry API. Эти провайдеры предлагают бесплатные API-кредиты или бесплатный тариф без поперечной тарификации.
Where can I get GPT-5.1 free API access?
LMSpeed currently lists 8 free API providerundefined other undefined} for GPT-5.1: 兔子API, 兔子API, 兔子API, 兔子API, 初叶🍂Furry API. Check each provider row before using it because free tier limits can change.

Также известна как

GPT-5.1b/gpt-5.1b/gpt-5.1-2025-11-13b/gpt-5.1-chat-latestcopilot/gpt-5.1

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API