Microsoft
·Released on 2025年1月10日

Phi 4 API 基准测试 价格和服务商数据

选择与 Phi 4 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Phi 4 页面汇总基准测试、API 价格和服务商数据,覆盖 2 家服务商,价格从 $0.010/request 起。页面同时展示实测速度和首字延迟。

Microsoft 的 Phi 4是轻量语言模型,专为低延迟、低成本的通用对话任务优化。

质量
0.0
LMSpeed 评分
速度
#72of 79
43char/s
1.32 s
成本
#17of 183
$0.010/ 1M · 8:1 in:out
$0.0016 in · $0.0084 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
6 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体28.3代码39.3综合推理39.1知识37.4数学46.9多语言-多模态-指令遵循37.8
#1数学46.9估算2/4 实测维度
80% 区间: 35.158.7
foundational math47.3
math_500 · math_500
competition math46.6
aime · aime
proof frontier仅先验
applied tool math仅先验
#2代码39.3暂定评分1/4 实测维度
80% 区间: 25.353.2
code generation39.3
livecodebench · livecodebench / scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality仅先验
#3综合推理39.1正式评分全站排名 #643/4 实测维度
80% 区间: 30.447.8
abstract logic仅先验
scientific causal41.9
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints45.2
mmlu_pro · mmlu_pro
evidence verification30.2
lcr · lcr
#4指令遵循37.8暂定评分1/4 实测维度
80% 区间: 21.853.8
constraint following仅先验
structured output仅先验
novel instruction generalization37.8
ifbench · aa_if_bench
long multiturn instruction仅先验
#5知识37.4暂定评分1/4 实测维度
80% 区间: 21.453.4
broad knowledge37.4
aa_omniscience · aa_omniscience_index
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#6智能体28.3暂定评分1/4 实测维度
80% 区间: 12.344.3
planning仅先验
tool use28.3
tau · tau2_bench
environment execution仅先验
recovery reliability仅先验
暂无数据:多语言多模态

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
16.4Ktokens
19.7 pages of text
OUTPUT
14.7Ktokens
8K128K1M4M
16.4K

能力

Technical Details

输入
输出
发布日期
Jan 2025
知识截止
2024-06-30
Tokenizer
Other
架构
text->text
内容审核
支持参数
frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetop_ktop_p

排名

擅长

相对落后

详细分数

更新时间: 2026年9月3日

速度与延迟

2 个指标

输出速度41.9 tok/s#72 / 79首字延迟1.00 s#28 / 79
输出速度
Output speed
站内排名#72
分数41.9 tok/s
更新时间2026年9月3日
置信度4
首字延迟
Time to first token
站内排名#28
分数1.00 s
更新时间2026年9月3日
置信度4

价格

2 个指标

输入价格$0.125/M#17 / 183输出价格$0.500/M#22 / 183
输入价格
Input price
站内排名#17
分数$0.125/M
更新时间2026年9月3日
置信度4
输出价格
Output price
站内排名#22
分数$0.500/M
更新时间2026年9月3日
置信度4

智能体

V3.0

0 个指标 · 暂定评分

分数28.380% 区间12.3–44.31/4 实测维度
维度与证据
规划拆解仅先验
工具调用28.3
1 个基准族 · 1 个指标
tau · tau2_bench · z -3.00 · q 1.00
环境与长程执行仅先验
恢复与完成可靠性仅先验

代码

V3.0

3 个指标 · 暂定评分

分数39.380% 区间25.3–53.21/4 实测维度LiveCodeBench23.1%#102 / 115SciCode26.0%#177 / 208
维度与证据
代码生成39.3
2 个基准族 · 2 个指标
livecodebench · livecodebench · z -0.74 · q 1.00
scicode · scicode · z -1.19 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量仅先验
LiveCodeBenchV3 计分证据
站内排名#102
分数23.1%
更新时间2026年9月3日
置信度4
SciCodeV3 计分证据
站内排名#177
分数26.0%
更新时间2026年9月3日
置信度4
AA-SciCodeV3 计分证据
站内排名#102
分数26.0
更新时间2026年8月14日
置信度1

综合推理

V3.0

3 个指标 · 正式评分

分数39.1#6480% 区间30.4–47.83/4 实测维度MMLU-Pro71.4%#98 / 129GPQA57.5%#176 / 215
维度与证据
抽象逻辑仅先验
科学与因果推理41.9
3 个基准族 · 3 个指标
critpt · critpt · z -0.72 · q 1.00
gpqa · gpqa · z -0.87 · q 1.00
hle · hle · z -0.92 · q 1.00
多步约束45.2
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z -0.84 · q 1.00
证据整合与验证30.2
1 个基准族 · 1 个指标
lcr · lcr · z -3.00 · q 1.00
MMLU-ProV3 计分证据
站内排名#98
分数71.4%
更新时间2026年9月3日
置信度4
GPQAV3 计分证据
站内排名#176
分数57.5%
更新时间2026年9月3日
置信度4
HLEV3 计分证据
站内排名#187
分数3.8%
更新时间2026年9月3日
置信度4

知识

V3.0

5 个指标 · 暂定评分

分数37.480% 区间21.4–53.41/4 实测维度Artificial Analysis Intelligence Index4.5#110 / 112AA-GPQA Diamond57.5#101 / 109
维度与证据
广泛知识37.4
1 个基准族 · 1 个指标
aa_omniscience · aa_omniscience_index · z -1.76 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#110
分数4.5
更新时间2026年8月14日
置信度1
AA-GPQA Diamond
站内排名#101
分数57.5
更新时间2026年8月14日
置信度1
AA-HLE
站内排名#103
分数3.8
更新时间2026年8月14日
置信度1
AA-Omniscience Accuracy
站内排名#100
分数14.1
更新时间2026年8月14日
置信度1
AA-Omniscience Hallucination Rate
站内排名#40
分数81.2
更新时间2026年8月14日
置信度1

数学

V3.0

2 个指标 · 估算

分数46.980% 区间35.1–58.72/4 实测维度AIME14.3%#52 / 68MATH-50081.0%#48 / 73
维度与证据
基础数学47.3
1 个基准族 · 1 个指标
math_500 · math_500 · z -0.34 · q 1.00
竞赛数学46.6
1 个基准族 · 1 个指标
aime · aime · z -0.48 · q 1.00
高阶证明仅先验
应用与工具辅助数学仅先验
AIMEV3 计分证据
站内排名#52
分数14.3%
更新时间2026年9月3日
置信度4
MATH-500V3 计分证据
站内排名#48
分数81.0%
更新时间2026年9月3日
置信度4

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理仅先验
视频与落地行动仅先验

指令遵循

V3.0

1 个指标 · 暂定评分

分数37.880% 区间21.8–53.81/4 实测维度AA-IFBench23.5#83 / 84
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化37.8
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z -1.91 · q 1.00
多轮与长指令仅先验
AA-IFBenchV3 计分证据
站内排名#83
分数23.5
更新时间2026年8月14日
置信度1

OpenRouter 端点

1 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
DeepInfra
deepinfra/bf16
$0.070/M$0.140/M100%undefined tokens / undefined tokens

价格对比

对比 Phi 4 在 2 家服务商的 API 价格。价格从 $0.010/request 到 $57.53/M,其中 素墨API 提供最低价 $0.010/request。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
phi-4
enterprise_emergency_standby
$57.53/M
$57.53/M
L1
100%
phi-4
default
$0.010/request
-

替代方案与相似模型

常见问题

Phi 4 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Phi 4 的基准测试、API 价格、输出速度、首字延迟和 2 家服务商数据。
Phi 4 API 价格是多少?
Phi 42 家服务商有价格记录,价格从 $0.010/request $57.53/M。最低价由 素墨API 提供。
Phi 4 API 价格表包含什么?
Phi 4 API 价格表会对比 2 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Phi 4 API 价格最低?
素墨API 当前提供 Phi 4 的最低收录价格:$0.010/request,共对比 2 家服务商。
可以同时对比 Phi 4 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Phi 4 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Phi 4 的 API 免费吗?
Phi 4 目前在 LMSpeed 上没有免费 API 方案,2 家服务商均按 token 计费。

别名

Phi-4microsoft/phi-4openrouter:microsoft/phi-4phi-4

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档