MoonshotAI
·Released on 2026年7月16日

Kimi K3 API 基准测试 价格和服务商数据

选择与 Kimi K3 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Kimi K3 页面汇总基准测试、API 价格和服务商数据,覆盖 147 家服务商,价格从 $0.0030/request 起。Kimi K3 免费 API 额度来自 5 家服务商。页面同时展示实测速度和首字延迟。

Kimi K3 is an ultra-large-scale, open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly stron...

质量
#3of 110
80.0
LMSpeed 评分
速度
#77of 80
154char/s
31.37 s
成本
#158of 185
$0.0030/ 1M · 8:1 in:out
$0.0005 in · $0.0025 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
5 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体65.8代码55.8综合推理59知识59.3数学-多语言-多模态64.9指令遵循-
#1智能体65.8正式评分全站排名 #13/4 实测维度
80% 区间: 58.573.0
planning仅先验
tool use63.7
mcp_atlas · mcp_atlas / tau · aa_tau3_banking
environment execution68.4
browsecomp · browse_comp / deep_search_qa · deep_search_qa / enterprise_ops_gym · aa_enterprise_ops_gym / gdpval_aa · benchlm_agentic_gdpval_aa / itbench · aa_itbench / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability65.2
apex_agents · apex_agents_aa / briefcase · aa_briefcase_elo / harvey_lab · aa_harvey_lab / jobbench · job_bench
#2多模态64.9估算2/4 实测维度
80% 区间: 53.676.2
perception ocr仅先验
document spatial60.9
charxiv · charxiv
visual reasoning68.9
mathvision · math_vision / mmmu_pro · mmmu_pro
video action仅先验
#3知识59.3暂定评分1/4 实测维度
80% 区间: 45.373.3
broad knowledge59.3
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#4综合推理59估算2/4 实测维度
80% 区间: 48.269.8
abstract logic仅先验
scientific causal58
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification60
lcr · lcr
#5代码55.8估算2/4 实测维度
80% 区间: 43.967.7
code generation57.3
scicode · scicode
repository engineering仅先验
debugging testing仅先验
tooling quality54.3
terminalbench · aa_terminal_bench21
暂无数据:数学多语言指令遵循

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
943.7Ktokens
8K128K1M4M
1.0M

能力

Technical Details

输入
输出
发布日期
Jul 2026
Tokenizer
Other
架构
text+image+video->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月5日

综合

6 个指标

Overall score80.0#3 / 110DeepSWE67.5#7 / 21
Overall score
站内排名#3
分数80.0
更新时间2026年9月5日
置信度3
DeepSWE
站内排名#7
分数67.5
更新时间2026年9月5日
置信度3
SWE-Marathon
站内排名#1
分数42.0
更新时间2026年9月5日
置信度3
ExploitBench
站内排名#5
分数32.0
更新时间2026年9月5日
置信度3
The Last Ones steps
站内排名#1
分数17.0
更新时间2026年9月5日
置信度3
The Last Ones completion
站内排名#2
分数10.0
更新时间2026年9月5日
置信度3

速度与延迟

2 个指标

输出速度37.9 tok/s#77 / 80首字延迟3.13 s#60 / 80
输出速度
Output speed
站内排名#77
分数37.9 tok/s
更新时间2026年9月5日
置信度4
首字延迟
Time to first token
站内排名#60
分数3.13 s
更新时间2026年9月5日
置信度4

价格

2 个指标

输入价格$3.00/M#158 / 185输出价格$15.00/M#158 / 185
输入价格
Input price
站内排名#158
分数$3.00/M
更新时间2026年9月5日
置信度4
输出价格
Output price
站内排名#158
分数$15.00/M
更新时间2026年9月5日
置信度4

智能体

V3.0

22 个指标 · 正式评分

分数65.8#180% 区间58.5–73.03/4 实测维度Agentic score91.0#2 / 76GDPval-AA1668.0#9 / 72
维度与证据
规划拆解仅先验
工具调用63.7
2 个基准族 · 2 个指标
mcp_atlas · mcp_atlas · z 1.21 · q 1.00
tau · aa_tau3_banking · z 0.55 · q 1.00
环境与长程执行68.4
6 个基准族 · 6 个指标
browsecomp · browse_comp · z 1.19 · q 1.00
deep_search_qa · deep_search_qa · z 1.20 · q 1.00
enterprise_ops_gym · aa_enterprise_ops_gym · z 0.16 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 1.16 · q 1.00
itbench · aa_itbench · z 0.70 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 2.14 · q 1.00
恢复与完成可靠性65.2
4 个基准族 · 4 个指标
apex_agents · apex_agents_aa · z 0.94 · q 1.00
briefcase · aa_briefcase_elo · z 0.41 · q 1.00
harvey_lab · aa_harvey_lab · z 1.07 · q 1.00
jobbench · job_bench · z 0.91 · q 1.00
Agentic score
站内排名#2
分数91.0
更新时间2026年9月5日
置信度3
GDPval-AAV3 计分证据
站内排名#9
分数1668.0
更新时间2026年9月5日
置信度3
AA BriefcaseV3 计分证据
站内排名#7
分数1505.0
更新时间2026年9月5日
置信度3
BrowseCompV3 计分证据
站内排名#3
分数91.2
更新时间2026年9月5日
置信度3
DeepSearchQAV3 计分证据
站内排名#1
分数95.0
更新时间2026年9月5日
置信度3
Toolathlon-Verified
站内排名#5
分数73.2
更新时间2026年9月5日
置信度3
MCP AtlasV3 计分证据
站内排名#3
分数84.2
更新时间2026年9月5日
置信度3
AutomationBench
站内排名#6
分数30.8
更新时间2026年9月5日
置信度3
JobBenchV3 计分证据
站内排名#4
分数52.9
更新时间2026年9月5日
置信度3
APEX-Agents
站内排名#2
分数37.6
更新时间2026年9月5日
置信度3
SpreadsheetBench 2
站内排名#1
分数34.8
更新时间2026年9月5日
置信度3
DECK-Bench
站内排名#1
分数73.5
更新时间2026年9月5日
置信度3
AA Agentic Index
站内排名#8
分数54.3
更新时间2026年9月5日
置信度3
GDPval-AA
站内排名#8
分数58.4
更新时间2026年9月5日
置信度3
AA AutomationBench
站内排名#2
分数52.7
更新时间2026年9月5日
置信度3
AA Tau3 BankingV3 计分证据
站内排名#6
分数46.0
更新时间2026年9月5日
置信度3
Terminal-Bench 2.0V3 计分证据
站内排名#2
分数88.3
更新时间2026年9月5日
置信度3
AA EnterpriseOps-GymV3 计分证据
站内排名#9
分数45.3
更新时间2026年9月5日
置信度3
AA Harvey LABV3 计分证据
站内排名#1
分数94.6
更新时间2026年9月5日
置信度3
APEX-Agents-AAV3 计分证据
站内排名#2
分数41.3
更新时间2026年9月5日
置信度3
AA ITBenchV3 计分证据
站内排名#3
分数47.7
更新时间2026年9月5日
置信度3
Terminal-Bench 2.1 (Vals)
站内排名#6
分数80.9
更新时间2026年9月5日
置信度3

代码

V3.0

20 个指标 · 估算

分数55.880% 区间43.9–67.72/4 实测维度SciCode59.5%#2 / 37FrontierSWE81.2#1 / 2
维度与证据
代码生成57.3
1 个基准族 · 1 个指标
scicode · scicode · z 0.82 · q 1.00
仓库工程仅先验
调试与测试仅先验
工具化开发与质量54.3
1 个基准族 · 1 个指标
terminalbench · aa_terminal_bench21 · z 0.08 · q 1.00
SciCodeV3 计分证据
站内排名#2
分数59.5%
更新时间2026年9月5日
置信度4
FrontierSWE
站内排名#1
分数81.2
更新时间2026年9月5日
置信度3
Kimi Code Bench v2
站内排名#1
分数72.9
更新时间2026年9月5日
置信度3
ProgramBench
站内排名#3
分数77.8
更新时间2026年9月5日
置信度3
PostTrain Bench
站内排名#1
分数36.6
更新时间2026年9月5日
置信度3
MLS-Bench Lite
站内排名#1
分数48.3
更新时间2026年9月5日
置信度3
AA Coding Index
站内排名#10
分数76.2
更新时间2026年9月5日
置信度3
AA-SciCodeV3 计分证据
站内排名#4
分数58.7
更新时间2026年9月5日
置信度3
AA Terminal-Bench 2.1V3 计分证据
站内排名#10
分数85.0
更新时间2026年9月5日
置信度3
Coding score
站内排名#11
分数72.7
更新时间2026年9月5日
置信度3
VulcanBench v3
站内排名#11
分数73.7
更新时间2026年9月5日
置信度3
CursorBench v3.2
站内排名#12
分数60.8
更新时间2026年9月5日
置信度3
OpenHarmony Bench
站内排名#3
分数57.3
更新时间2026年9月5日
置信度3
FrontierSWE v2
站内排名#5
分数25.9
更新时间2026年9月5日
置信度3
LiveCodeBench (Vals)
站内排名#14
分数87.2
更新时间2026年9月5日
置信度3
SWE-bench (Vals)
站内排名#7
分数93.4
更新时间2026年9月5日
置信度3
APEX-SWE
站内排名#4
分数48.0
更新时间2026年8月20日
置信度2
EEBench
站内排名#10
分数38.3
更新时间2026年8月20日
置信度2
InferenceEval
站内排名#5
分数39.8
更新时间2026年8月20日
置信度2
KernelBench Internal
站内排名#3
分数68.5
更新时间2026年8月20日
置信度2

综合推理

V3.0

5 个指标 · 估算

分数5980% 区间48.2–69.82/4 实测维度GPQA93.5%#7 / 217HLE46.9%#12 / 214
维度与证据
抽象逻辑仅先验
科学与因果推理58
3 个基准族 · 4 个指标
critpt · critpt · z 0.87 · q 1.00
gpqa · gpqa · z 0.39 · q 1.00
hle · hle · z 0.45 · q 1.00
hle · hle_no_tools · z 0.09 · q 1.00
多步约束仅先验
证据整合与验证60
1 个基准族 · 1 个指标
lcr · lcr · z 0.90 · q 1.00
GPQAV3 计分证据
站内排名#7
分数93.5%
更新时间2026年9月5日
置信度4
HLEV3 计分证据
站内排名#12
分数46.9%
更新时间2026年9月5日
置信度4
AA-LCRV3 计分证据
站内排名#2
分数82.7
更新时间2026年9月5日
置信度3
CritPtV3 计分证据
站内排名#11
分数23.4
更新时间2026年9月5日
置信度3
Reasoning score
站内排名#4
分数78.5
更新时间2026年9月5日
置信度3

知识

V3.0

12 个指标 · 暂定评分

分数59.380% 区间45.3–73.31/4 实测维度Knowledge score82.1#11 / 82GPQA-D93.5#7 / 32
维度与证据
广泛知识59.3
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.78 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z 0.73 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#11
分数82.1
更新时间2026年9月5日
置信度3
GPQA-D
站内排名#7
分数93.5
更新时间2026年9月5日
置信度3
HLE w/o tools
站内排名#8
分数43.5
更新时间2026年9月5日
置信度3
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#7
分数59.7
更新时间2026年9月5日
置信度3
AA-GPQA Diamond
站内排名#9
分数93.5
更新时间2026年9月5日
置信度3
AA-HLE
站内排名#11
分数46.9
更新时间2026年9月5日
置信度3
AA-Omniscience IndexV3 计分证据
站内排名#19
分数19.7
更新时间2026年9月5日
置信度3
AA-Omniscience Accuracy
站内排名#21
分数47.6
更新时间2026年9月5日
置信度3
AA-Omniscience Hallucination Rate
站内排名#72
分数53.2
更新时间2026年9月5日
置信度3
GPQA Diamond (Vals)
站内排名#12
分数92.9
更新时间2026年9月5日
置信度3
MMLU-Pro (Vals)
站内排名#18
分数88.0
更新时间2026年9月5日
置信度3
AA Openness Index
站内排名#4
分数38.9
更新时间2026年9月4日
置信度2

数学

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
基础数学仅先验
竞赛数学仅先验
高阶证明仅先验
应用与工具辅助数学仅先验

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

16 个指标 · 估算

分数64.980% 区间53.6–76.22/4 实测维度Multimodal Grounded score88.8#1 / 55OfficeQA Pro63.3#3 / 10
维度与证据
感知与 OCR仅先验
文档与空间理解60.9
1 个基准族 · 1 个指标
charxiv · charxiv · z 1.60 · q 1.00
视觉推理68.9
2 个基准族 · 2 个指标
mathvision · math_vision · z 3.00 · q 1.00
mmmu_pro · mmmu_pro · z 0.80 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#1
分数88.8
更新时间2026年9月5日
置信度3
OfficeQA Pro
站内排名#3
分数63.3
更新时间2026年9月5日
置信度3
MMMU-ProV3 计分证据
站内排名#6
分数81.6
更新时间2026年9月5日
置信度3
MMMU-Pro w/ Python
站内排名#2
分数83.4
更新时间2026年9月5日
置信度3
CharXiv w/o tools
站内排名#3
分数84.8
更新时间2026年9月5日
置信度3
CharXivV3 计分证据
站内排名#2
分数91.3
更新时间2026年9月5日
置信度3
MathVisionV3 计分证据
站内排名#2
分数94.3
更新时间2026年9月5日
置信度3
MathVision w/ Python
站内排名#1
分数97.8
更新时间2026年9月5日
置信度3
BabyVision w/ Python
站内排名#2
分数85.7
更新时间2026年9月5日
置信度3
ZeroBench
站内排名#4
分数23.0
更新时间2026年9月5日
置信度3
ZeroBench w/ Python
站内排名#2
分数41.0
更新时间2026年9月5日
置信度3
WorldVQA ForceAnswer
站内排名#1
分数51.0
更新时间2026年9月5日
置信度3
OmniDocBench
站内排名#1
分数91.1
更新时间2026年9月5日
置信度3
PerceptionBench
站内排名#2
分数58.5
更新时间2026年9月5日
置信度3
AA-MMMU-Pro
站内排名#11
分数80.5
更新时间2026年9月5日
置信度3
Design Arena Website
站内排名#1
分数1361.0
更新时间2026年9月5日
置信度3

指令遵循

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化仅先验
多轮与长指令仅先验

OpenRouter 端点

18 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
Modal
modal/mxfp4
$3/M$15/M99.9%undefined tokens / undefined tokens
Sail Research
sail-research/fp4
$2.60/M$13/M99.9%undefined tokens / undefined tokens
Wafer
wafer
$3/M$12.75/M99.9%undefined tokens / undefined tokens
DigitalOcean
digitalocean
$2.85/M$14.25/M99.9%undefined tokens / undefined tokens
Moonshot AI
moonshotai/mxfp4
$3/M$15/M99.9%undefined tokens / undefined tokens
Fireworks
fireworks
$3/M$15/M99.8%undefined tokens / undefined tokens
Together
together
$3/M$15/M99.5%undefined tokens / undefined tokens
Chutes
chutes/mxfp4
$3/M$15/M99.1%undefined tokens / undefined tokens
Morph
morph/fp4
$2.50/M$14/M99.0%undefined tokens / undefined tokens
Fireworks
fireworks/us
$3.30/M$16.50/M98.8%undefined tokens / undefined tokens
Morph
morph/fast
$6/M$22.50/M98.7%undefined tokens / undefined tokens
DeepInfra
deepinfra/bf16
$2.85/M$14.25/M98.6%undefined tokens / undefined tokens
Makora
makora
$2.55/M$12.75/M98.4%undefined tokens / undefined tokens
Phala
phala
$3/M$15/M95.3%undefined tokens / undefined tokens
BaseTen
baseten/fp8
$3/M$15/M95.2%undefined tokens / undefined tokens
Alibaba
alibaba
$3.45/M$17.25/M93.0%undefined tokens / undefined tokens
Fireworks
fireworks/fast
$4.50/M$22.50/M92.1%undefined tokens / undefined tokens
Parasail
parasail/fp4
$3/M$15/M91.5%undefined tokens / undefined tokens

价格对比

对比 Kimi K3 在 142 家服务商的 API 价格。价格从 $0.0030/request 到 $749250.00/M,其中 Crond 提供最低价 $0.0030/request。 5 家服务商提供免费 API 额度或免费套餐。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
99%
kimi-k3
kimi-sale
-38%$1.86/M
Cache read$0.186/M
-38%$9.29/M
L1
100%
Kimi-K3
default
$0.280/request
-
L1
100%
kimi-k3
sale
$10.00/M
$50.00/M
L1
99%
kimi-k3
Moonshot
-85%$0.441/M
Cache read$0.044/M
-85%$2.20/M
L1
100%
kimi-k3
default
-9%$2.74/M
-9%$13.70/M
L1
100%
kimi-k3
纯AZ
$4.11/M
Cache read$0.411/M
$20.55/M
兔子API
免费
L1
100%
kimi-k3
官方优惠
免费
免费
APIMart
免费
L1
100%
kimi-k3
default
免费
免费
L1
100%
kimi-k3
deepseek
-63%$1.10/M
Cache read$0.110/M
-63%$5.48/M
L1
99%
kimi-k3
default
-40%$1.80/M
Cache read$0.180/M
-40%$9.00/M
L1
100%
kimi-k3
Kimi-officially
-27%$2.19/M
Cache read$0.219/M
-27%$10.96/M
L1
100%
kimi-k3
deepseek-低价
$20.00/M
$100.00/M
L1
100%
L2
39%
kimi-k3
default
$75.00/M
$75.00/M
L1
100%
熊猫-按量-满血非量化-kimi-k3
default
-99%$0.044/M
Cache read$10.07/M
-99%$0.222/M
L1
100%
kimi-k3
default
-65%$1.04/M
-65%$5.18/M
L1
99%
kimi-k3
kimi
-63%$1.10/M
Cache read$0.110/M
-63%$5.48/M
L1
100%
kimi-k3
default
-54%$1.37/M
Cache read$0.137/M
-54%$6.85/M
L1
99%
kimi-k3
Kimi
-9%$2.74/M
Cache read$0.274/M
-9%$13.70/M
L1
100%
[mt]q|次/kimi-k3
default
$27.00/request
-
L1
100%
[lq]q|SK/kimi-k3
default
$30.00/request
-
当前显示 20 个模型 ID,共 81 个。

替代方案与相似模型

常见问题

Kimi K3 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Kimi K3 的基准测试、API 价格、输出速度、首字延迟和 147 家服务商数据。
Kimi K3 API 价格是多少?
Kimi K3147 家服务商有价格记录,价格从 $0.0030/request $749250.00/M。最低价由 Crond 提供。
Kimi K3 API 价格表包含什么?
Kimi K3 API 价格表会对比 147 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Kimi K3 API 价格最低?
Crond 当前提供 Kimi K3 的最低收录价格:$0.0030/request,共对比 147 家服务商。
可以同时对比 Kimi K3 API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Kimi K3 API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Kimi K3 的 API 免费吗?
是的,Kimi K3 免费 API 可通过 LMSpeed 上的 5 家服务商使用,包括兔子API, APIMart, Zero API, Dext API, 兔子API。这些服务商提供免费 API 额度或免费套餐,无需按 token 计费。
哪里可以使用 Kimi K3 免费 API?
LMSpeed 当前收录了 5 家 Kimi K3 免费 API 服务商,包括兔子API, APIMart, Zero API, Dext API, 兔子API。免费额度和限制可能变化,使用前请查看每一行服务商数据。

别名

Kimi-K3[ba]q|按次/moonshotai/Kimi-K3[ba]u|moonshotai/Kimi-K3[hm]q|nv/kimi-k3[hm]u|moonshotai/Kimi-K3

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档