MoonshotAI
·Released on 2026年1月27日

Kimi K2.5 API 基准测试 价格和服务商数据

选择与 Kimi K2.5 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Kimi K2.5 页面汇总基准测试、API 价格和服务商数据,覆盖 237 家服务商,价格从 $0.0008/request 起。Kimi K2.5 免费 API 额度来自 4 家服务商。页面同时展示实测速度和首字延迟。

Moonshot 的 Kimi K2.5是语言模型,专为通用对话与文本生成任务优化。

质量
#77of 100
48.0
LMSpeed 评分
速度
144char/s
11.93 s
成本
#93of 180
$0.0008/ 1M · 8:1 in:out
$0.0001 in · $0.0007 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
8 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体39.1代码48.4综合推理55.5知识47.1数学49.2多语言44.2多模态52.7指令遵循54
#1综合推理55.5正式评分全站排名 #153/4 实测维度
80% 区间: 47.263.8
abstract logic仅先验
scientific causal56.7
critpt · critpt / gpqa · gpqa / hle · hle
multistep constraints58.5
mmlu_pro · mmlu_pro
evidence verification51.4
lcr · lcr / longbench · long_bench_v2
#2指令遵循54估算2/4 实测维度
80% 区间: 42.166.0
constraint following55.6
ifeval · ifeval
structured output仅先验
novel instruction generalization52.5
ifbench · aa_if_bench
long multiturn instruction仅先验
#3多模态52.7估算2/4 实测维度
80% 区间: 40.764.7
perception ocr仅先验
document spatial仅先验
visual reasoning50.5
mmmu_pro · mmmu_pro
video action54.8
video_mmmu · video_mmmu
#4数学49.2估算3/4 实测维度
80% 区间: 40.258.2
foundational math仅先验
competition math51.7
aime · aime2025 / aime · aime2026 / hmmt · hmmt_feb2025 / hmmt · hmmt_feb2026 / hmmt · hmmt_nov2025
proof frontier51.2
frontiermath · frontier_math_v2_tier4 / frontiermath · frontier_math_v2_tiers13
applied tool math44.8
mmanswer · mm_answer_bench
#5代码48.4正式评分全站排名 #283/4 实测维度
80% 区间: 40.656.2
code generation52.4
livecodebench · live_code_bench_v6 / scicode · scicode
repository engineering44
react_native_bench · react_native_evals / swe_pro · swe_pro / vibecode · vibe_code_bench
debugging testing48.8
swe_multilingual · benchlm_coding_swe_multilingual / swe_rebench · swe_rebench / swe_verified · swe_verified
tooling quality仅先验
#6知识47.1暂定评分1/4 实测维度
80% 区间: 30.863.4
broad knowledge仅先验
professional knowledge47.1
supergpqa · super_gpqa
factuality仅先验
retrieval open book仅先验
#7多语言44.2估算2/4 实测维度
80% 区间: 32.056.4
cross language understanding42.6
nova · nova63
multilingual generation仅先验
reasoning transfer45.8
mmlu_prox · mmlu_pro_x
low resource robustness仅先验
#8智能体39.1正式评分全站排名 #544/4 实测维度
80% 区间: 34.044.2
planning48.4
deep_planning · gert_labs
tool use30.1
mcp_atlas · mcp_atlas / mcp_tasks · mcp_tasks / tau · tau2_bench / tau · tau3_bench / toolathlon · toolathlon
environment execution43.1
browsecomp · browse_comp / deep_search_qa · deep_search_qa / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2 / wide_research · wide_research
recovery reliability34.7
apex_agents · apex_agents_aa / claw_eval · claw_eval / jobbench · job_bench / researchclaw · research_claw_bench

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
262.1Ktokens
314.6 pages of text
OUTPUT
235.9Ktokens
8K128K1M4M
262.1K

能力

Technical Details

输入
输出
发布日期
Jan 2026
Tokenizer
Other
架构
text+image->text
内容审核
到期日期
2026-08-31
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年8月29日

综合

1 个指标

Overall score48.0#77 / 100
Overall score
站内排名#77
分数48.0
更新时间2026年8月28日
置信度4

价格

2 个指标

输入价格$0.600/M#93 / 180输出价格$3.00/M#97 / 180
输入价格
Input price
站内排名#93
分数$0.600/M
更新时间2026年8月29日
置信度4
输出价格
Output price
站内排名#97
分数$3.00/M
更新时间2026年8月29日
置信度4

智能体

V3.0

20 个指标 · 正式评分

分数39.1#5480% 区间34.0–44.24/4 实测维度Agentic score29.3#61 / 69Terminal-Bench 2.050.8#44 / 53
维度与证据
规划拆解48.4
1 个基准族 · 1 个指标
deep_planning · gert_labs · z -0.20 · q 1.00
工具调用30.1
4 个基准族 · 5 个指标
mcp_atlas · mcp_atlas · z -3.00 · q 1.00
mcp_tasks · mcp_tasks · z -1.25 · q 0.63
tau · tau2_bench · z 0.73 · q 1.00
tau · tau3_bench · z -1.71 · q 1.00
toolathlon · toolathlon · z -2.21 · q 1.00
环境与长程执行43.1
5 个基准族 · 5 个指标
browsecomp · browse_comp · z -1.35 · q 1.00
deep_search_qa · deep_search_qa · z -0.24 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z -0.48 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z -0.79 · q 1.00
wide_research · wide_research · z -0.46 · q 1.00
恢复与完成可靠性34.7
4 个基准族 · 4 个指标
apex_agents · apex_agents_aa · z -1.17 · q 1.00
claw_eval · claw_eval · z -1.16 · q 1.00
jobbench · job_bench · z -2.19 · q 1.00
researchclaw · research_claw_bench · z -1.37 · q 1.00
Agentic score
站内排名#61
分数29.3
更新时间2026年8月28日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#44
分数50.8
更新时间2026年8月26日
置信度4
BrowseCompV3 计分证据
站内排名#29
分数60.6
更新时间2026年8月26日
置信度4
Claw-EvalV3 计分证据
站内排名#23
分数52.3
更新时间2026年8月26日
置信度4
QwenClawBench
站内排名#5
分数54.3
更新时间2026年8月26日
置信度4
Τ³-bench resultsV3 计分证据
站内排名#8
分数65.7
更新时间2026年8月26日
置信度4
DeepSearchQAV3 计分证据
站内排名#8
分数77.1
更新时间2026年8月26日
置信度4
DeepPlanningV3 计分证据
站内排名#7
分数14.4
更新时间2026年8月26日
置信度4
ToolathlonV3 计分证据
站内排名#23
分数27.8
更新时间2026年8月26日
置信度4
MCP AtlasV3 计分证据
站内排名#31
分数29.5
更新时间2026年8月26日
置信度4
MCP-TasksV3 计分证据
站内排名#5
分数59.1
更新时间2026年8月26日
置信度4
WideResearchV3 计分证据
站内排名#7
分数72.7
更新时间2026年8月26日
置信度4
Τ²-bench resultsV3 计分证据
站内排名#13
分数95.9
更新时间2026年8月26日
置信度4
APEX-Agents-AAV3 计分证据
站内排名#19
分数11.5
更新时间2026年8月26日
置信度4
Gert LabsV3 计分证据
站内排名#29
分数45.9
更新时间2026年8月26日
置信度4
ResearchClawBenchV3 计分证据
站内排名#16
分数14.0
更新时间2026年8月26日
置信度4
JobBenchV3 计分证据
站内排名#22
分数8.7
更新时间2026年8月26日
置信度4
AA Agentic Index
站内排名#46
分数21.7
更新时间2026年8月26日
置信度4
GDPval-AA
站内排名#45
分数25.3
更新时间2026年8月26日
置信度4
GDPval-AAV3 计分证据
站内排名#45
分数1006.0
更新时间2026年8月26日
置信度4

代码

V3.0

13 个指标 · 正式评分

分数48.4#2880% 区间40.6–56.23/4 实测维度SciCode39.6%#92 / 205Coding score50.8#53 / 81
维度与证据
代码生成52.4
2 个基准族 · 2 个指标
livecodebench · live_code_bench_v6 · z -0.32 · q 0.75
scicode · scicode · z 0.98 · q 1.00
仓库工程44
3 个基准族 · 3 个指标
react_native_bench · react_native_evals · z -0.10 · q 1.00
swe_pro · swe_pro · z -1.10 · q 1.00
vibecode · vibe_code_bench · z -0.36 · q 1.00
调试与测试48.8
3 个基准族 · 3 个指标
swe_multilingual · benchlm_coding_swe_multilingual · z -0.38 · q 1.00
swe_rebench · swe_rebench · z -0.15 · q 1.00
swe_verified · swe_verified · z 0.00 · q 1.00
工具化开发与质量仅先验
SciCodeV3 计分证据
站内排名#92
分数39.6%
更新时间2026年8月29日
置信度4
Coding score
站内排名#53
分数50.8
更新时间2026年8月28日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#27
分数76.8
更新时间2026年8月26日
置信度4
SWE-bench Verified*
站内排名#4
分数70.8
更新时间2026年8月26日
置信度4
LiveCodeBench v6V3 计分证据
站内排名#4
分数85.0
更新时间2026年8月26日
置信度4
SWE-bench ProV3 计分证据
站内排名#46
分数50.7
更新时间2026年8月26日
置信度4
SWE MultilingualV3 计分证据
站内排名#16
分数73.0
更新时间2026年8月26日
置信度4
SWE-RebenchV3 计分证据
站内排名#8
分数58.5
更新时间2026年8月26日
置信度4
React Native EvalsV3 计分证据
站内排名#7
分数77.2
更新时间2026年8月26日
置信度4
SciCodeV3 计分证据
站内排名#5
分数48.7
更新时间2026年8月26日
置信度4
AA-SciCodeV3 计分证据
站内排名#33
分数49.0
更新时间2026年8月26日
置信度4
AA Coding Index
站内排名#47
分数46.8
更新时间2026年8月26日
置信度4
Vibe Code BenchV3 计分证据
站内排名#23
分数17.5
更新时间2026年8月20日
置信度2

综合推理

V3.0

7 个指标 · 正式评分

分数55.5#1580% 区间47.2–63.83/4 实测维度MMLU-Pro87.1%#12 / 129GPQA78.9%#98 / 212
维度与证据
抽象逻辑仅先验
科学与因果推理56.7
3 个基准族 · 3 个指标
critpt · critpt · z 0.04 · q 1.00
gpqa · gpqa · z 0.73 · q 1.00
hle · hle · z 0.67 · q 1.00
多步约束58.5
1 个基准族 · 1 个指标
mmlu_pro · mmlu_pro · z 0.94 · q 1.00
证据整合与验证51.4
2 个基准族 · 2 个指标
lcr · lcr · z 0.20 · q 1.00
longbench · long_bench_v2 · z 0.00 · q 1.00
MMLU-ProV3 计分证据
站内排名#12
分数87.1%
更新时间2026年8月26日
置信度4
GPQAV3 计分证据
站内排名#98
分数78.9%
更新时间2026年8月29日
置信度4
HLEV3 计分证据
站内排名#103
分数13.2%
更新时间2026年8月29日
置信度4
Reasoning score
站内排名#25
分数44.9
更新时间2026年8月28日
置信度4
LongBench v2V3 计分证据
站内排名#5
分数61.0
更新时间2026年8月26日
置信度4
AA-LCRV3 计分证据
站内排名#39
分数73.0
更新时间2026年8月26日
置信度4
CritPtV3 计分证据
站内排名#50
分数3.1
更新时间2026年8月26日
置信度4

知识

V3.0

9 个指标 · 暂定评分

分数47.180% 区间30.8–63.41/4 实测维度Knowledge score57.4#51 / 69GPQA-D87.6#24 / 31
维度与证据
广泛知识仅先验
专业知识47.1
1 个基准族 · 1 个指标
supergpqa · super_gpqa · z -0.13 · q 1.00
事实性仅先验
检索与开放资料运用仅先验
Knowledge score
站内排名#51
分数57.4
更新时间2026年8月26日
置信度4
GPQA-D
站内排名#24
分数87.6
更新时间2026年8月26日
置信度4
SuperGPQAV3 计分证据
站内排名#9
分数69.2
更新时间2026年8月26日
置信度4
MMLU-Pro (Arcee)
站内排名#2
分数87.1
更新时间2026年8月26日
置信度4
Artificial Analysis Intelligence Index
站内排名#55
分数36.0
更新时间2026年8月26日
置信度4
AA-GPQA Diamond
站内排名#41
分数87.9
更新时间2026年8月26日
置信度4
AA-HLE
站内排名#41
分数30.7
更新时间2026年8月26日
置信度4
AA-Omniscience Accuracy
站内排名#41
分数35.2
更新时间2026年8月26日
置信度4
AA-Omniscience Hallucination Rate
站内排名#59
分数65.7
更新时间2026年8月26日
置信度4

数学

V3.0

10 个指标 · 估算

分数49.280% 区间40.2–58.23/4 实测维度Math score62.5#26 / 62AIME 202596.1#1 / 4
维度与证据
基础数学仅先验
竞赛数学51.7
2 个基准族 · 5 个指标
aime · aime2025 · z 0.63 · q 0.50
aime · aime2026 · z 0.48 · q 1.00
hmmt · hmmt_feb2025 · z 0.31 · q 0.88
hmmt · hmmt_feb2026 · z -0.05 · q 1.00
hmmt · hmmt_nov2025 · z -0.83 · q 1.00
高阶证明51.2
1 个基准族 · 2 个指标
frontiermath · frontier_math_v2_tier4 · z -0.24 · q 1.00
frontiermath · frontier_math_v2_tiers13 · z 0.12 · q 1.00
应用与工具辅助数学44.8
1 个基准族 · 1 个指标
mmanswer · mm_answer_bench · z -0.65 · q 1.00
Math score
站内排名#26
分数62.5
更新时间2026年8月26日
置信度4
AIME 2025V3 计分证据
站内排名#1
分数96.1
更新时间2026年8月26日
置信度4
AIME26V3 计分证据
站内排名#4
分数95.8
更新时间2026年8月26日
置信度4
AIME25 (Arcee)
站内排名#2
分数96.3
更新时间2026年8月26日
置信度4
HMMT Feb 2025V3 计分证据
站内排名#3
分数95.4
更新时间2026年8月26日
置信度4
HMMT Nov 2025V3 计分证据
站内排名#7
分数91.1
更新时间2026年8月26日
置信度4
HMMT Feb 2026V3 计分证据
站内排名#12
分数87.1
更新时间2026年8月26日
置信度4
MMAnswerBenchV3 计分证据
站内排名#7
分数81.8
更新时间2026年8月26日
置信度4
FrontierMath v2 (Tiers 1-3)V3 计分证据
站内排名#21
分数27.9
更新时间2026年8月26日
置信度4
FrontierMath v2 (Tier 4)V3 计分证据
站内排名#22
分数4.2
更新时间2026年8月26日
置信度4

多语言

V3.0

3 个指标 · 估算

分数44.280% 区间32.0–56.42/4 实测维度Multilingual score38.2#7 / 11MMLU-ProX82.3#7 / 11
维度与证据
跨语言理解42.6
1 个基准族 · 1 个指标
nova · nova63 · z -1.00 · q 0.88
多语言生成仅先验
推理迁移45.8
1 个基准族 · 1 个指标
mmlu_prox · mmlu_pro_x · z -0.36 · q 1.00
低资源鲁棒性仅先验
Multilingual score
站内排名#7
分数38.2
更新时间2026年8月26日
置信度4
MMLU-ProXV3 计分证据
站内排名#7
分数82.3
更新时间2026年8月26日
置信度4
NOVA-63V3 计分证据
站内排名#6
分数56.0
更新时间2026年8月26日
置信度4

多模态

V3.0

7 个指标 · 估算

分数52.780% 区间40.7–64.72/4 实测维度Multimodal Grounded score60.7#24 / 44MMMU-Pro78.5#16 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解仅先验
视觉推理50.5
1 个基准族 · 1 个指标
mmmu_pro · mmmu_pro · z 0.00 · q 1.00
视频与落地行动54.8
1 个基准族 · 1 个指标
video_mmmu · video_mmmu · z 1.40 · q 1.00
Multimodal Grounded score
站内排名#24
分数60.7
更新时间2026年8月28日
置信度4
MMMU-ProV3 计分证据
站内排名#16
分数78.5
更新时间2026年8月26日
置信度4
Video-MME
站内排名#1
分数87.4
更新时间2026年8月26日
置信度4
MMVU
站内排名#2
分数80.4
更新时间2026年8月26日
置信度4
VideoMMMUV3 计分证据
站内排名#3
分数86.6
更新时间2026年8月26日
置信度4
AA-MMMU-Pro
站内排名#29
分数75.4
更新时间2026年8月26日
置信度4
Design Arena Website
站内排名#30
分数1269.0
更新时间2026年8月26日
置信度4

指令遵循

V3.0

3 个指标 · 估算

分数5480% 区间42.1–66.02/4 实测维度Instruction Following score91.0#6 / 25IFEval93.9#5 / 16
维度与证据
约束遵循55.6
1 个基准族 · 1 个指标
ifeval · ifeval · z 0.54 · q 1.00
结构化输出仅先验
新指令泛化52.5
1 个基准族 · 1 个指标
ifbench · aa_if_bench · z 0.06 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#6
分数91.0
更新时间2026年8月26日
置信度4
IFEvalV3 计分证据
站内排名#5
分数93.9
更新时间2026年8月26日
置信度4
AA-IFBenchV3 计分证据
站内排名#36
分数70.2
更新时间2026年8月26日
置信度4

OpenRouter 端点

10 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Moonshot AI
moonshotai/int4
$0.600/M$3/M100.0%undefined tokens / undefined tokens
SiliconFlow
siliconflow/int4
$0.450/M$2.25/M100.0%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp4
$0.450/M$2.25/M99.9%undefined tokens / undefined tokens
AtlasCloud
atlas-cloud/int4
$0.490/M$2.50/M99.8%undefined tokens / undefined tokens
DigitalOcean
digitalocean
$0.500/M$2.70/M99.8%undefined tokens / undefined tokens
Amazon Bedrock
amazon-bedrock/us-east-2
$0.600/M$3/M99.7%undefined tokens / undefined tokens
Venice
venice
$0.532/M$3.32/M99.1%undefined tokens / undefined tokens
StreamLake
streamlake/fp8
$0.540/M$2.70/M98.8%undefined tokens / undefined tokens
Novita
novita
$0.570/M$2.85/M97.9%undefined tokens / undefined tokens
Phala
phala
$0.600/M$3/M87.2%undefined tokens / undefined tokens

价格对比

对比 Kimi K2.5 在 233 家服务商的 API 价格。价格从 $0.0008/request 到 $3496.50/M,其中 MyDamoxing 提供最低价 $0.0008/request。 4 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
kimi-k2.5
default
$1.00/request
-
65.6 t/s
13.20 s
L1
99%
kimi-k2.5
default
$0.643/M
Cache read$0.107/M
$3.21/M
64.9 t/s
9.95 s
L1
100%
kimi-k2.5
bailian
-52%$0.286/M
Cache read$0.050/M
-50%$1.50/M
L1
100%
kimi-k2.5
default
-54%$0.274/M
-52%$1.44/M
L1
100%
Kimi-K2.5
default
$0.080/request
-
L1
100%
kimi-k2.5
sale
$2.00/M
$10.50/M
L1
100%
kimi-k2.5
default
-9%$0.548/M
-4%$2.88/M
兔子API
免费
L1
100%
kimi-k2.5
原价分组
免费
免费
L1
100%
kimi-k2.5
default
-73%$0.164/M
-71%$0.863/M
L1
100%
kimi-k2.5
default
-54%$0.274/M
-52%$1.44/M
L1
100%
kimi-k2.5
default
$0.600/M
$3.00/M
L1
100%
kimi-k2.5
default
-34%$0.394/M
-82%$0.532/M
L1
100%
kimi-k2.5
default
-9%$0.548/M
-4%$2.88/M
L1
100%
kimi-k2.5
Kimi-officially
-27%$0.438/M
Cache read$0.077/M
-23%$2.30/M
L1
100%
kimi-k2.5
国产模型
-16%$0.506/M
-11%$2.66/M
L1
100%
L2
62%
kimi-k2.5
default
-4%$0.574/M
Cache read$0.077/M
-20%$2.41/M
L1
100%
kimi-k2.5
default
$4.00/M
$21.00/M
L1
100%
kimi-k2.5-20260127
kimi
$0.0008/request
-
L1
100%
kimi-k2.5
kimi
$0.0008/request
-
L1
100%
kimi-k2.5
test
-86%$0.082/M
Cache read$0.014/M
-86%$0.411/M
当前显示 20 个模型 ID,共 85 个。

替代方案与相似模型

常见问题

Kimi K2.5 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Kimi K2.5 的基准测试、API 价格、输出速度、首字延迟和 237 家服务商数据。
Kimi K2.5 API 价格是多少?
Kimi K2.5237 家服务商有价格记录,价格从 $0.0008/request $3496.50/M。最低价由 MyDamoxing 提供。
Kimi K2.5 API 价格表包含什么?
Kimi K2.5 API 价格表会对比 237 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Kimi K2.5 API 价格最低?
MyDamoxing 当前提供 Kimi K2.5 的最低收录价格:$0.0008/request,共对比 237 家服务商。
可以同时对比 Kimi K2.5 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Kimi K2.5 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Kimi K2.5 的 API 免费吗?
是的,Kimi K2.5 免费 API 可通过 LMSpeed 上的 4 家服务商使用,包括Zero API, 兔子API, Dext API, Dext API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Kimi K2.5 免费 API?
LMSpeed 当前收录了 4 家 Kimi K2.5 免费 API 服务商,包括Zero API, 兔子API, Dext API, Dext API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

@cf/moonshotai/kimi-k2.5Kimi-K2.5Kimi-K2.5-globalKimi-k2.5Pro/moonshotai/Kimi-K2.5

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档