Phi 4 API 基准测试 价格和服务商数据
选择与 Phi 4 对比的模型
选择一个模型后会直接打开对应的对比页面。
Phi 4 页面汇总基准测试、API 价格和服务商数据,覆盖 2 家服务商,价格从 $0.010/request 起。页面同时展示实测速度和首字延迟。
Microsoft 的 Phi 4是轻量语言模型,专为低延迟、低成本的通用对话任务优化。
分类性能
基于独立 benchmark family 的实测能力估计,不确定性单独展示。
- 覆盖
- 6 / 8
- 方法论
- V3.0
#1数学46.9估算2/4 实测维度
#2代码39.3暂定评分1/4 实测维度
#3综合推理39.1正式评分全站排名 #643/4 实测维度
#4指令遵循37.8暂定评分1/4 实测维度
#5知识37.4暂定评分1/4 实测维度
#6智能体28.3暂定评分1/4 实测维度
技术规格
Input and output token limits for this model, plus how it ranks on long-context understanding.
能力
排名
擅长
相对落后
详细分数
更新时间: 2026年9月3日速度与延迟
2 个指标
输出速度41.9 tok/s#72 / 79首字延迟1.00 s#28 / 79
速度与延迟
2 个指标
价格
2 个指标
输入价格$0.125/M#17 / 183输出价格$0.500/M#22 / 183
价格
2 个指标
智能体
V3.00 个指标 · 暂定评分
分数28.380% 区间12.3–44.31/4 实测维度
智能体
V3.00 个指标 · 暂定评分
代码
V3.03 个指标 · 暂定评分
分数39.380% 区间25.3–53.21/4 实测维度LiveCodeBench23.1%#102 / 115SciCode26.0%#177 / 208
代码
V3.03 个指标 · 暂定评分
综合推理
V3.03 个指标 · 正式评分
分数39.1#6480% 区间30.4–47.83/4 实测维度MMLU-Pro71.4%#98 / 129GPQA57.5%#176 / 215
综合推理
V3.03 个指标 · 正式评分
知识
V3.05 个指标 · 暂定评分
分数37.480% 区间21.4–53.41/4 实测维度Artificial Analysis Intelligence Index4.5#110 / 112AA-GPQA Diamond57.5#101 / 109
知识
V3.05 个指标 · 暂定评分
数学
V3.02 个指标 · 估算
分数46.980% 区间35.1–58.72/4 实测维度AIME14.3%#52 / 68MATH-50081.0%#48 / 73
数学
V3.02 个指标 · 估算
多语言
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多语言
V3.00 个指标 · 暂无数据
多模态
V3.00 个指标 · 暂无数据
暂无数据80% 区间30.8–69.20/4 实测维度
多模态
V3.00 个指标 · 暂无数据
指令遵循
V3.01 个指标 · 暂定评分
分数37.880% 区间21.8–53.81/4 实测维度AA-IFBench23.5#83 / 84
指令遵循
V3.01 个指标 · 暂定评分
OpenRouter 端点
1 个端点来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。
| Provider endpoint | 输入 | 输出 | 1 天在线率 | 30m 延迟 | 30m 吞吐 | 上下文 / 输出 |
|---|---|---|---|---|---|---|
DeepInfra deepinfra/bf16 | $0.070/M | $0.140/M | 100% | — | — | undefined tokens / undefined tokens |
价格对比
对比 Phi 4 在 2 家服务商的 API 价格。价格从 $0.010/request 到 $57.53/M,其中 素墨API 提供最低价 $0.010/request。
替代方案与相似模型
GPT-5.4
gpt-5-4
OpenAI 的 GPT-5.4是语言模型,专为通用对话与文本生成任务优化。
GPT-5.2
gpt-5-2
OpenAI 的 GPT-5.2是语言模型,专为通用对话与文本生成任务优化。
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic 的 Claude Sonnet 4.6是语言模型,专为通用对话与文本生成任务优化。
Kimi K2.5
kimi-k2-5
Moonshot 的 Kimi K2.5是语言模型,专为通用对话与文本生成任务优化。
GLM-5
glm-5
Zhipu 的 GLM-5是旗舰大语言模型,专为高复杂度通用任务与多步推理优化。
DeepSeek R1
deepseek-r1
DeepSeek R1是推理专精模型,专为复杂推理、数学与逻辑任务优化。
常见问题
- Phi 4 包含哪些基准测试数据?
- LMSpeed 会在数据可用时展示 Phi 4 的基准测试、API 价格、输出速度、首字延迟和 2 家服务商数据。
- Phi 4 API 价格是多少?
- Phi 4 在 2 家服务商有价格记录,价格从 $0.010/request 到 $57.53/M。最低价由 素墨API 提供。
- Phi 4 API 价格表包含什么?
- Phi 4 API 价格表会对比 2 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
- 哪家服务商的 Phi 4 API 价格最低?
- 素墨API 当前提供 Phi 4 的最低收录价格:$0.010/request,共对比 2 家服务商。
- 可以同时对比 Phi 4 API 价格和速度吗?
- 可以。LMSpeed 会在同一页展示 Phi 4 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
- Phi 4 的 API 免费吗?
- Phi 4 目前在 LMSpeed 上没有免费 API 方案,2 家服务商均按 token 计费。
