OpenAI
·Released on 5 авг. 2025 г.

gpt-oss-120b API Benchmarks, Pricing & Provider Data

Compare gpt-oss-120b with another model

Choose a model to open its comparison page.

Share on X
LLM

gpt-oss-120b benchmark, API pricing, and provider data cover 98 API providers, with prices starting at $0.0030/request.

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose production use cases. It activates 5.1B par...

Качество
0.0
Оценка LMSpeed
Стоимость
#22of 180
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
7 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты35.9Программирование47.8Рассуждение49.2Знания55.2Математика53.7Многоязычность31.5Мультимодальность-Следование инструкциям52.1
#1Знания55.2Предварительная1/4 Измеренные измерения
80% интервал: 41.269.2
broad knowledge55.2
aa_omniscience · artificial_analysis / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#2Математика53.7Предварительная1/4 Измеренные измерения
80% интервал: 37.669.8
foundational math53.7
aa_math_index · artificial_analysis_math_index
competition mathТолько априорное
proof frontierТолько априорное
applied tool mathТолько априорное
#3Следование инструкциям52.1Предварительная1/4 Измеренные измерения
80% интервал: 36.168.1
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization52.1
ifbench · aa_if_bench
long multiturn instructionТолько априорное
#4Рассуждение49.2РейтинговаяОбщий рейтинг #423/4 Измеренные измерения
80% интервал: 40.657.9
abstract logicТолько априорное
scientific causal51.1
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints52.2
mmlu_pro · mmlu_pro
evidence verification44.5
lcr · lcr
#5Программирование47.8РейтинговаяОбщий рейтинг #293/4 Измеренные измерения
80% интервал: 38.756.9
code generation56
livecodebench · livecodebench / scicode · scicode
repository engineering44.9
react_native_bench · react_native_evals
debugging testingТолько априорное
tooling quality42.4
terminalbench · terminal_bench_hard
#6Агенты35.9РейтинговаяОбщий рейтинг #554/4 Измеренные измерения
80% интервал: 29.941.9
planning39.5
deep_planning · gert_labs
tool use46.1
tau · tau2_bench
environment execution32.8
enterprise_ops_gym · aa_enterprise_ops_gym / gdpval_aa · benchlm_agentic_gdpval_aa / itbench · aa_itbench
recovery reliability25
apex_agents · apex_agents_aa / briefcase · aa_briefcase_elo / harvey_lab · aa_harvey_lab
#7Многоязычность31.5Предварительная1/4 Измеренные измерения
80% интервал: 14.248.8
cross language understanding31.5
global_mmlu · aa_global_mmlu_lite
multilingual generationТолько априорное
reasoning transferТолько априорное
low resource robustnessТолько априорное
Нет данных:Мультимодальность

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
131.1Ktokens
157.3 pages of text
OUTPUT
131.1Ktokens
8K128K1M4M
131.1K

Возможности

Technical Details

Вход
Выход
Всего параметров
120B
Выпущена
Aug 2025
Срез знаний
2024-06-30
Документация
Токенизатор
GPT
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_atop_ktop_logprobstop_p

Rankings

Excels at

It's decent at

Falls behind in

Подробные оценки

Обновлено: 22 авг. 2026 г.

Скорость и задержка

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Скорость вывода153.1 tok/s#15 / 74Время до первого токена0.56 s#9 / 74
Скорость вывода
Output speed
Рейтинг LMSpeed#15
Оценка153.1 tok/s
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
Время до первого токена
Time to first token
Рейтинг LMSpeed#9
Оценка0.56 s
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.150/M#22 / 180Цена выходных данных$0.595/M#25 / 180
Цена входных данных
Input price
Рейтинг LMSpeed#22
Оценка$0.150/M
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#25
Оценка$0.595/M
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка35.9#5580% интервал29.9–41.94/4 Измеренные измеренияAA Agentic Index13.4#53 / 65APEX-Agents-AA3.1#21 / 23
Измерения и доказательства
Планирование и декомпозиция39.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
deep_planning · gert_labs · z -1.38 · q 1.00
Использование инструментов46.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
tau · tau2_bench · z -0.63 · q 1.00
Среда и длительное выполнение32.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
enterprise_ops_gym · aa_enterprise_ops_gym · z -2.64 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z -1.09 · q 1.00
itbench · aa_itbench · z -3.00 · q 1.00
Восстановление и надёжность завершения25
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
apex_agents · apex_agents_aa · z -2.93 · q 1.00
briefcase · aa_briefcase_elo · z -1.93 · q 1.00
harvey_lab · aa_harvey_lab · z -3.00 · q 1.00
AA Agentic Index
Рейтинг LMSpeed#53
Оценка13.4
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
APEX-Agents-AAДоказательство V3
Рейтинг LMSpeed#21
Оценка3.1
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
Τ²-bench resultsДоказательство V3
Рейтинг LMSpeed#60
Оценка65.8
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
GDPval-AA
Рейтинг LMSpeed#54
Оценка15.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
GDPval-AAДоказательство V3
Рейтинг LMSpeed#54
Оценка800.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
Gert LabsДоказательство V3
Рейтинг LMSpeed#46
Оценка29.6
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA ITBenchДоказательство V3
Рейтинг LMSpeed#8
Оценка5.6
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA EnterpriseOps-GymДоказательство V3
Рейтинг LMSpeed#12
Оценка25.5
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA Harvey LABДоказательство V3
Рейтинг LMSpeed#14
Оценка13.9
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA BriefcaseДоказательство V3
Рейтинг LMSpeed#15
Оценка8.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка47.8#2980% интервал38.7–56.93/4 Измеренные измеренияLiveCodeBench70.7%#29 / 115SciCode36.0%#120 / 204
Измерения и доказательства
Генерация кода56
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
livecodebench · livecodebench · z 1.34 · q 1.00
scicode · scicode · z 0.07 · q 1.00
Работа с репозиториями44.9
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
react_native_bench · react_native_evals · z -0.69 · q 1.00
Отладка и тестированиеТолько априорное
Инструментальная разработка и качество42.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
terminalbench · terminal_bench_hard · z -1.22 · q 1.00
LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#29
Оценка70.7%
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
SciCodeДоказательство V3
Рейтинг LMSpeed#120
Оценка36.0%
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
Coding score
Рейтинг LMSpeed#40
Оценка57.3
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
React Native EvalsДоказательство V3
Рейтинг LMSpeed#9
Оценка71.6
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA Coding Index
Рейтинг LMSpeed#56
Оценка30.4
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#75
Оценка38.9
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#3
Оценка87.8
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
Terminal-Bench HardДоказательство V3
Рейтинг LMSpeed#9
Оценка23.5
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка49.2#4280% интервал40.6–57.93/4 Измеренные измеренияMMLU-Pro77.5%#77 / 129GPQA67.2%#143 / 211
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение51.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z -0.39 · q 1.00
gpqa · gpqa · z 0.06 · q 1.00
hle · hle · z 0.27 · q 1.00
Многошаговые ограничения52.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z 0.09 · q 1.00
Интеграция и проверка свидетельств44.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z -1.10 · q 1.00
MMLU-ProДоказательство V3
Рейтинг LMSpeed#77
Оценка77.5%
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
GPQAДоказательство V3
Рейтинг LMSpeed#143
Оценка67.2%
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#151
Оценка5.9%
Источникartificialanalysis.ai
Обновлено22 авг. 2026 г.
Достоверность4
AA-LCRДоказательство V3
Рейтинг LMSpeed#79
Оценка51.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
CritPtДоказательство V3
Рейтинг LMSpeed#65
Оценка1.1
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка55.280% интервал41.2–69.21/4 Измеренные измеренияKnowledge score64.0#43 / 69Artificial Analysis Intelligence Index24.1#80 / 111
Измерения и доказательства
Широкие знания55.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · artificial_analysis · z 0.95 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z -0.33 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
Knowledge scoreДоказательство V3
Рейтинг LMSpeed#43
Оценка64.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#80
Оценка24.1
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA-GPQA Diamond
Рейтинг LMSpeed#75
Оценка78.2
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA-HLE
Рейтинг LMSpeed#67
Оценка19.6
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1
AA-Omniscience Accuracy
Рейтинг LMSpeed#81
Оценка21.8
Источникbenchlm.ai
Обновлено17 авг. 2026 г.
Достоверность1
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#17
Оценка90.8
Источникbenchlm.ai
Обновлено17 авг. 2026 г.
Достоверность1
AA Openness Index
Рейтинг LMSpeed#4
Оценка38.9
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1
AA MMLU-Pro
Рейтинг LMSpeed#3
Оценка80.8
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка53.780% интервал37.6–69.81/4 Измеренные измеренияAA AIME 202593.4#2 / 2
Измерения и доказательства
Базовая математика53.7
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_math_index · artificial_analysis_math_index · z 0.90 · q 1.00
Олимпиадная математикаТолько априорное
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное
AA AIME 2025
Рейтинг LMSpeed#2
Оценка93.4
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка31.580% интервал14.2–48.81/4 Измеренные измеренияAA Global-MMLU-Lite82.8#4 / 4
Измерения и доказательства
Межъязыковое понимание31.5
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
global_mmlu · aa_global_mmlu_lite · z -3.00 · q 0.50
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное
AA Global-MMLU-LiteДоказательство V3
Рейтинг LMSpeed#4
Оценка82.8
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

80% интервал30.8–69.20/4 Измеренные измеренияDesign Arena Website979.0#71 / 75
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное
Design Arena Website
Рейтинг LMSpeed#71
Оценка979.0
Источникbenchlm.ai
Обновлено19 авг. 2026 г.
Достоверность1

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка52.180% интервал36.1–68.11/4 Измеренные измеренияAA-IFBench69.0#39 / 84
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций52.1
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z 0.01 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#39
Оценка69.0
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Эндпоинты OpenRouter

20 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Cerebras
cerebras/fp16
$0.350/M$0.750/M100.0%undefined токенов / undefined токенов
Parasail
parasail/fp4
$0.100/M$0.750/M100.0%undefined токенов / undefined токенов
Groq
groq
$0.150/M$0.600/M99.9%undefined токенов / undefined токенов
DigitalOcean
digitalocean
$0.055/M$0.385/M99.9%undefined токенов / —
DeepInfra
deepinfra/turbo
$0.150/M$0.600/M99.8%undefined токенов / undefined токенов
BaseTen
baseten/fp4
$0.100/M$0.500/M99.6%undefined токенов / undefined токенов
AkashML
akashml/bf16
$0.037/M$0.490/M99.3%undefined токенов / undefined токенов
Mancer 2
mancer/fp8
$0.085/M$0.500/M99.3%undefined токенов / undefined токенов
Phala
phala
$0.150/M$0.600/M98.9%undefined токенов / undefined токенов
CoreWeave
coreweave/fp4
$0.030/M$0.170/M98.4%undefined токенов / undefined токенов
Nebius
nebius/fp4
$0.150/M$0.600/M97.7%undefined токенов / —
Mara
mara
$0.150/M$0.750/M97.0%undefined токенов / undefined токенов
SambaNova
sambanova
$0.140/M$0.950/M96.3%undefined токенов / undefined токенов
Together
together
$0.150/M$0.600/M94.2%undefined токенов / —
DeepInfra
deepinfra/bf16
$0.037/M$0.170/M93.2%undefined токенов / undefined токенов
Google
google-vertex/global
$0.090/M$0.360/M90.0%undefined токенов / undefined токенов
Amazon Bedrock
amazon-bedrock
$0.150/M$0.600/M89.9%undefined токенов / —
Novita
novita/fp4
$0.050/M$0.250/M85.6%undefined токенов / undefined токенов
SiliconFlow
siliconflow/fp8
$0.050/M$0.450/M67.9%undefined токенов / undefined токенов
Amazon Bedrock
amazon-bedrock/eu-west-1
$0.150/M$0.600/Mundefined токенов / —

Сравнение цен

Compare gpt-oss-120b API pricing across 98 providers. Prices range from $0.0030/request to $399.60/M. Crond offers the lowest rate at $0.0030/request.

ПровайдерРаботоспособностьВариант моделиГруппаВходные данные ($/M)Выходные данные ($/M)Скорость (т/с)Первый токенАудит
L1
100%
gpt-oss-120b
default
-75%$0.037/M
-71%$0.170/M
L1
99%
gpt-oss-120b
default
-7%$0.140/M
-6%$0.561/M
L1
99%
[极速0.04/次]GPT-OSS-120B
default
$0.037/request
-
L1
99%
gpt-oss-120b
default
-7%$0.140/M
-6%$0.561/M
L1
47%
gpt-oss-120b
default
$399.60/M
$1598.40/M
L1
100%
gpt-oss-120b
mix
-97%$0.0041/M
-97%$0.016/M
L1
100%
gpt-oss-120b
default
-50%$0.075/M
-49%$0.301/M
L1
0%
gpt-oss-120b-免费
免费玩耍
$0.0030/request
-

Альтернативы и похожие модели

Frequently Asked Questions

What benchmark data does gpt-oss-120b include?
LMSpeed shows gpt-oss-120b benchmark context, API price, output speed, first-token latency, and provider data across 98 providers when those signals are available.
Сколько стоит API gpt-oss-120b?
gpt-oss-120b has pricing from 98 providers, ranging from $0.0030/request to $399.60/M. Crond has the lowest listed price.
What does the gpt-oss-120b API pricing table include?
The gpt-oss-120b API pricing table compares 98 providers by input price, output price, free tier status, speed, first-token latency, and recent health data when available.
У какого провайдера самая низкая цена API gpt-oss-120b?
Crond currently has the lowest listed gpt-oss-120b price at $0.0030/request across 98 providers.
Является ли API gpt-oss-120b бесплатным?
У gpt-oss-120b в настоящее время нет бесплатного тарифа API на LMSpeed. Все 98 провайдеров взимают плату за token.

Также известна как

[极速0.04/次]GPT-OSS-120Bgpt-oss-120bgpt-oss-120b-免费openai/gpt-oss-120b:free

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API