Phi 4 API Benchmarks, Pricing & Provider Data
Compare Phi 4 with another model
Choose a model to open its comparison page.
Phi 4 benchmark, API pricing, and provider data cover 2 API providers, with prices starting at $0.010/request. The page also shows measured API speed and first-token latency.
Microsoft Phi-4 is a compact open-weight language model in the Phi series, optimized for reasoning, math, code generation, and efficient on-device or API deployment.
Производительность по категориям
Оценки наблюдаемой способности; неопределённость независимых семейств бенчмарков показана отдельно.
- Покрытие
- 6 / 8
- Методология
- V3.0
#1Математика46.9Оценка2/4 Измеренные измерения
#2Рассуждение39.3РейтинговаяОбщий рейтинг #653/4 Измеренные измерения
#3Следование инструкциям37.8Предварительная1/4 Измеренные измерения
#4Знания37.4Предварительная1/4 Измеренные измерения
#5Программирование36.8Предварительная1/4 Измеренные измерения
#6Агенты28.3Предварительная1/4 Измеренные измерения
Specifications
Input and output token limits for this model, plus how it ranks on long-context understanding.
Возможности
Rankings
Excels at
Falls behind in
Подробные оценки
Обновлено: 5 сент. 2026 г.Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Скорость вывода40.8 tok/s#74 / 80Время до первого токена1.17 s#35 / 80
Скорость и задержка
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Цена входных данных$0.125/M#17 / 185Цена выходных данных$0.500/M#22 / 185
Цены
undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}}
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка28.380% интервал12.3–44.31/4 Измеренные измерения
Агенты
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка36.880% интервал22.9–50.71/4 Измеренные измеренияLiveCodeBench23.1%#102 / 115AA-SciCode26.0#106 / 113
Программирование
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Оценка39.3#6580% интервал30.6–47.93/4 Измеренные измеренияMMLU-Pro71.4%#98 / 129GPQA57.5%#178 / 217
Рассуждение
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Рейтинговая
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка37.480% интервал21.4–53.41/4 Измеренные измеренияArtificial Analysis Intelligence Index4.5#115 / 117AA-GPQA Diamond57.5#105 / 113
Знания
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Оценка46.980% интервал35.1–58.72/4 Измеренные измеренияAIME14.3%#52 / 68MATH-50081.0%#48 / 73
Математика
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Оценка
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Многоязычность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Нет данных80% интервал30.8–69.20/4 Измеренные измерения
Мультимодальность
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Нет данных
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Оценка37.880% интервал21.8–53.81/4 Измеренные измеренияAA-IFBench23.5#83 / 84
Следование инструкциям
V3.0undefined метрика} few undefined метрики} many undefined метрик} other undefined метрики}} · Предварительная
Эндпоинты OpenRouter
1 эндпоинтовСторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.
| Provider endpoint | Вход | Вывод | Доступность 1 день | Задержка 30м | Пропускная способность 30м | Контекст / вывод |
|---|---|---|---|---|---|---|
DeepInfra deepinfra/bf16 | $0.070/M | $0.140/M | 100% | — | — | undefined токенов / undefined токенов |
Сравнение цен
Compare Phi 4 API pricing across 2 providers. Prices range from $0.010/request to $57.53/M. 素墨API offers the lowest rate at $0.010/request.
Альтернативы и похожие модели
GPT-5.4
gpt-5-4
OpenAI GPT-5.4 extends the GPT-5 family with stronger instruction following, deeper tool use, and improved performance on coding, math, and long-document analysis.
GPT-5.2
gpt-5-2
OpenAI GPT-5.2 is a GPT-5 series model emphasizing advanced reasoning, multimodal understanding, and high-quality outputs for complex enterprise workloads.
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic Claude Sonnet 4.6 extends the Sonnet line with improved tool use, coding reliability, and long-context performance for everyday production workloads.
Kimi K2.5
kimi-k2-5
Moonshot Kimi K2.5 is an open-weight multimodal agent model with native vision and text input, strong coding performance, and a 256K context window.
GLM-5
glm-5
Zhipu GLM-5 is Zhipu flagship GLM series model with enhanced reasoning, agent capabilities, and strong performance on Chinese enterprise and coding scenarios.
MiniMax M2.7
minimax-m2-7
MiniMax M2.7 is a high-tier M2-series model tuned for complex reasoning, long-context dialogue, and production-grade API workloads.
Frequently Asked Questions
- What benchmark data does Phi 4 include?
- LMSpeed shows Phi 4 benchmark context, API price, output speed, first-token latency, and provider data across 2 providers when those signals are available.
- Сколько стоит API Phi 4?
- Phi 4 has pricing from 2 providers, ranging from $0.010/request to $57.53/M. 素墨API has the lowest listed price.
- What does the Phi 4 API pricing table include?
- The Phi 4 API pricing table compares 2 providers by input price, output price, free tier status, speed, first-token latency, and recent health data when available.
- У какого провайдера самая низкая цена API Phi 4?
- 素墨API currently has the lowest listed Phi 4 price at $0.010/request across 2 providers.
- Can I compare Phi 4 API price and speed together?
- Yes. LMSpeed shows Phi 4 API price, output speed, first-token latency, and provider health on the same page so you can compare cost and performance together.
- Является ли API Phi 4 бесплатным?
- У Phi 4 в настоящее время нет бесплатного тарифа API на LMSpeed. Все 2 провайдеров взимают плату за token.
