Microsoft
·Released on 10 янв. 2025 г.

Phi 4 API Benchmarks, Pricing & Provider Data

Compare Phi 4 with another model

Choose a model to open its comparison page.

Share on X
LLM

Phi 4 benchmark, API pricing, and provider data cover 2 API providers, with prices starting at $0.010/request. The page also shows measured API speed and first-token latency.

Microsoft Phi-4 is a compact open-weight language model in the Phi series, optimized for reasoning, math, code generation, and efficient on-device or API deployment.

Качество
0.0
Оценка LMSpeed
Скорость
#74of 80
43char/s
1.32 s
Стоимость
#17of 185
$0.010/ 1M · 8:1 in:out
$0.0016 in · $0.0084 out

Производительность по категориям

Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.

Покрытие
6 / 8
Методология
V3.0
Производительность по категориямОценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.Агенты28.3Программирование36.8Рассуждение39.3Знания37.4Математика46.9Многоязычность-Мультимодальность-Следование инструкциям37.8
#1Математика46.9Оценка2/4 Измеренные измерения
80% интервал: 35.158.7
foundational math47.3
math_500 · math_500
competition math46.6
aime · aime
proof frontierТолько априорное
applied tool mathТолько априорное
#2Рассуждение39.3РейтинговаяОбщий рейтинг #653/4 Измеренные измерения
80% интервал: 30.647.9
abstract logicТолько априорное
scientific causal41.9
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints45.2
mmlu_pro · mmlu_pro
evidence verification30.8
lcr · lcr
#3Следование инструкциям37.8Предварительная1/4 Измеренные измерения
80% интервал: 21.853.8
constraint followingТолько априорное
structured outputТолько априорное
novel instruction generalization37.8
ifbench · aa_if_bench
long multiturn instructionТолько априорное
#4Знания37.4Предварительная1/4 Измеренные измерения
80% интервал: 21.453.4
broad knowledge37.4
aa_omniscience · aa_omniscience_index
professional knowledgeТолько априорное
factualityТолько априорное
retrieval open bookТолько априорное
#5Программирование36.8Предварительная1/4 Измеренные измерения
80% интервал: 22.950.7
code generation36.8
livecodebench · livecodebench / scicode · aa_sci_code
repository engineeringТолько априорное
debugging testingТолько априорное
tooling qualityТолько априорное
#6Агенты28.3Предварительная1/4 Измеренные измерения
80% интервал: 12.344.3
planningТолько априорное
tool use28.3
tau · tau2_bench
environment executionТолько априорное
recovery reliabilityТолько априорное
Нет данных:МногоязычностьМультимодальность

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
16.4Ktokens
19.7 pages of text
OUTPUT
14.7Ktokens
8K128K1M4M
16.4K

Возможности

Technical Details

Вход
Выход
Выпущена
Jan 2025
Срез знаний
2024-06-30
Документация
Токенизатор
Other
Архитектура
text->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetop_ktop_p

Rankings

Excels at

Falls behind in

Подробные оценки

Обновлено: 5 сент. 2026 г.

Скорость и задержка

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Скорость вывода40.8 tok/s#74 / 80Время до первого токена1.17 s#35 / 80
Скорость вывода
Output speed
Рейтинг LMSpeed#74
Оценка40.8 tok/s
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
Время до первого токена
Time to first token
Рейтинг LMSpeed#35
Оценка1.17 s
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4

Цены

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}

Цена входных данных$0.125/M#17 / 185Цена выходных данных$0.500/M#22 / 185
Цена входных данных
Input price
Рейтинг LMSpeed#17
Оценка$0.125/M
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
Цена выходных данных
Output price
Рейтинг LMSpeed#22
Оценка$0.500/M
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4

Агенты

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка28.380% интервал12.3–44.31/4 Измеренные измерения
Измерения и доказательства
Планирование и декомпозицияТолько априорное
Использование инструментов28.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
tau · tau2_bench · z -3.00 · q 1.00
Среда и длительное выполнениеТолько априорное
Восстановление и надёжность завершенияТолько априорное

Программирование

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка36.880% интервал22.9–50.71/4 Измеренные измеренияLiveCodeBench23.1%#102 / 115AA-SciCode26.0#106 / 113
Измерения и доказательства
Генерация кода36.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
livecodebench · livecodebench · z -0.74 · q 1.00
scicode · aa_sci_code · z -1.78 · q 1.00
Работа с репозиториямиТолько априорное
Отладка и тестированиеТолько априорное
Инструментальная разработка и качествоТолько априорное
LiveCodeBenchДоказательство V3
Рейтинг LMSpeed#102
Оценка23.1%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
AA-SciCodeДоказательство V3
Рейтинг LMSpeed#106
Оценка26.0
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Рассуждение

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая

Оценка39.3#6580% интервал30.6–47.93/4 Измеренные измеренияMMLU-Pro71.4%#98 / 129GPQA57.5%#178 / 217
Измерения и доказательства
Абстрактная логикаТолько априорное
Научное и причинное рассуждение41.9
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
critpt · critpt · z -0.71 · q 1.00
gpqa · gpqa · z -0.89 · q 1.00
hle · hle · z -0.93 · q 1.00
Многошаговые ограничения45.2
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
mmlu_pro · mmlu_pro · z -0.84 · q 1.00
Интеграция и проверка свидетельств30.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
lcr · lcr · z -3.00 · q 1.00
MMLU-ProДоказательство V3
Рейтинг LMSpeed#98
Оценка71.4%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
GPQAДоказательство V3
Рейтинг LMSpeed#178
Оценка57.5%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
HLEДоказательство V3
Рейтинг LMSpeed#189
Оценка3.8%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4

Знания

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка37.480% интервал21.4–53.41/4 Измеренные измеренияArtificial Analysis Intelligence Index4.5#115 / 117AA-GPQA Diamond57.5#105 / 113
Измерения и доказательства
Широкие знания37.4
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aa_omniscience · aa_omniscience_index · z -1.76 · q 1.00
Профессиональные знанияТолько априорное
ФактологичностьТолько априорное
Поиск и открытые источникиТолько априорное
Artificial Analysis Intelligence IndexДоказательство V3
Рейтинг LMSpeed#115
Оценка4.5
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1
AA-GPQA Diamond
Рейтинг LMSpeed#105
Оценка57.5
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1
AA-HLE
Рейтинг LMSpeed#108
Оценка3.8
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1
AA-Omniscience Accuracy
Рейтинг LMSpeed#104
Оценка14.1
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1
AA-Omniscience Hallucination Rate
Рейтинг LMSpeed#40
Оценка81.2
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Математика

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка

Оценка46.980% интервал35.1–58.72/4 Измеренные измеренияAIME14.3%#52 / 68MATH-50081.0%#48 / 73
Измерения и доказательства
Базовая математика47.3
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
math_500 · math_500 · z -0.34 · q 1.00
Олимпиадная математика46.6
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
aime · aime · z -0.48 · q 1.00
Продвинутые доказательстваТолько априорное
Прикладная математика и инструментыТолько априорное
AIMEДоказательство V3
Рейтинг LMSpeed#52
Оценка14.3%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4
MATH-500Доказательство V3
Рейтинг LMSpeed#48
Оценка81.0%
Источникartificialanalysis.ai
Обновлено5 сент. 2026 г.
Достоверность4

Многоязычность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Межъязыковое пониманиеТолько априорное
Многоязычная генерацияТолько априорное
Перенос рассужденийТолько априорное
Устойчивость для малоресурсных языковТолько априорное

Мультимодальность

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных

Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Измерения и доказательства
Восприятие и OCRТолько априорное
Документы и пространственное пониманиеТолько априорное
Визуальное рассуждениеТолько априорное
Видео и действия в средеТолько априорное

Следование инструкциям

V3.0

undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная

Оценка37.880% интервал21.8–53.81/4 Измеренные измеренияAA-IFBench23.5#83 / 84
Измерения и доказательства
Соблюдение ограниченийТолько априорное
Структурированный выводТолько априорное
Обобщение новых инструкций37.8
undefined семейство} few undefined семейства} many undefined семейств} other undefined семейства}} · undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
ifbench · aa_if_bench · z -1.91 · q 1.00
Многоходовые и длинные инструкцииТолько априорное
AA-IFBenchДоказательство V3
Рейтинг LMSpeed#83
Оценка23.5
Источникbenchlm.ai
Обновлено14 авг. 2026 г.
Достоверность1

Эндпоинты OpenRouter

1 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
DeepInfra
deepinfra/bf16
$0.070/M$0.140/M100%undefined токенов / undefined токенов

Сравнение цен

Compare Phi 4 API pricing across 2 providers. Prices range from $0.010/request to $57.53/M. 素墨API offers the lowest rate at $0.010/request.

ПровайдерРаботоспособностьВариант моделиГруппаВходные данные ($/M)Выходные данные ($/M)Скорость (т/с)Первый токенАудит
L1
100%
phi-4
enterprise_emergency_standby
$57.53/M
$57.53/M
L1
100%
phi-4
default
$0.010/request
-

Альтернативы и похожие модели

Frequently Asked Questions

What benchmark data does Phi 4 include?
LMSpeed shows Phi 4 benchmark context, API price, output speed, first-token latency, and provider data across 2 providers when those signals are available.
Сколько стоит API Phi 4?
Phi 4 has pricing from 2 providers, ranging from $0.010/request to $57.53/M. 素墨API has the lowest listed price.
What does the Phi 4 API pricing table include?
The Phi 4 API pricing table compares 2 providers by input price, output price, free tier status, speed, first-token latency, and recent health data when available.
У какого провайдера самая низкая цена API Phi 4?
素墨API currently has the lowest listed Phi 4 price at $0.010/request across 2 providers.
Can I compare Phi 4 API price and speed together?
Yes. LMSpeed shows Phi 4 API price, output speed, first-token latency, and provider health on the same page so you can compare cost and performance together.
Является ли API Phi 4 бесплатным?
У Phi 4 в настоящее время нет бесплатного тарифа API на LMSpeed. Все 2 провайдеров взимают плату за token.

Также известна как

Phi-4microsoft/phi-4openrouter:microsoft/phi-4phi-4

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API