Thinking Machines
·Released on 2026年7月17日

Inkling API 基准测试 价格和服务商数据

选择与 Inkling 对比的模型

选择一个模型后会直接打开对应的对比页面。

分享到 X
LLM

Inkling 页面汇总基准测试、API 价格和服务商数据,覆盖 21 家服务商,价格从 $0.00000001/request 起。页面同时展示实测速度和首字延迟。

Inkling is an open-weight multimodal mixture-of-experts model from Thinking Machines Lab, with 41B active parameters out of 975B total. It is designed for general-purpose reasoning, coding, agentic an...

质量
#48of 112
60.0
LMSpeed 评分
速度
#52of 81
25char/s
0.79 s
成本
#113of 186
$0.00000001/ 1M · 8:1 in:out
$0.0000000016 in · $0.0000000084 out

分类性能

基于独立 benchmark family 的实测能力估计,不确定性单独展示。

覆盖
7 / 8
方法论
V3.0
分类性能基于独立 benchmark family 的实测能力估计,不确定性单独展示。智能体48.6代码47.9综合推理55.2知识51.3数学65.4多语言-多模态45.7指令遵循56.4
#1数学65.4暂定评分1/4 实测维度
80% 区间: 49.081.7
foundational math仅先验
competition math65.4
aime · aime2026
proof frontier仅先验
applied tool math仅先验
#2指令遵循56.4暂定评分1/4 实测维度
80% 区间: 40.472.4
constraint following仅先验
structured output仅先验
novel instruction generalization56.4
ifbench · if_bench
long multiturn instruction仅先验
#3综合推理55.2估算2/4 实测维度
80% 区间: 44.466.0
abstract logic仅先验
scientific causal55.9
critpt · critpt / gpqa · gpqa / hle · hle / hle · hle_no_tools
multistep constraints仅先验
evidence verification54.5
lcr · lcr
#4知识51.3暂定评分1/4 实测维度
80% 区间: 37.365.3
broad knowledge51.3
aa_omniscience · aa_omniscience_index / benchlm_category_knowledge · benchlm_category_knowledge
professional knowledge仅先验
factuality仅先验
retrieval open book仅先验
#5智能体48.6正式评分全站排名 #423/4 实测维度
80% 区间: 40.356.8
planning仅先验
tool use50.3
mcp_atlas · mcp_atlas / tau · aa_tau3_banking
environment execution50
browsecomp · browse_comp / enterprise_ops_gym · aa_enterprise_ops_gym / gdpval_aa · benchlm_agentic_gdpval_aa / terminalbench · benchlm_agentic_terminal_bench2
recovery reliability45.4
briefcase · aa_briefcase_elo
#6代码47.9正式评分全站排名 #294/4 实测维度
80% 区间: 41.054.7
code generation54
scicode · scicode
repository engineering45.6
swe_pro · swe_pro
debugging testing51.3
swe_verified · swe_verified
tooling quality40.6
terminalbench · aa_terminal_bench21 / terminalbench · benchlm_coding_terminal_bench2
#7多模态45.7估算2/4 实测维度
80% 区间: 33.857.6
perception ocr仅先验
document spatial49.4
charxiv · charxiv
visual reasoning42
mmmu_pro · mmmu_pro
video action仅先验
暂无数据:多语言

技术规格

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1.0Mtokens
1.3K pages of text
OUTPUT
32.8Ktokens
8K128K1M4M
1.0M

能力

Technical Details

输入
输出
发布日期
Jul 2026
Tokenizer
Other
架构
text+image+audio->text
内容审核
支持参数
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_p

排名

擅长

表现尚可

相对落后

详细分数

更新时间: 2026年9月12日

综合

1 个指标

Overall score60.0#48 / 112
Overall score
站内排名#48
分数60.0
更新时间2026年9月12日
置信度4

速度与延迟

2 个指标

输出速度83.3 tok/s#52 / 81首字延迟2.63 s#56 / 81
输出速度
Output speed
站内排名#52
分数83.3 tok/s
更新时间2026年9月12日
置信度4
首字延迟
Time to first token
站内排名#56
分数2.63 s
更新时间2026年9月12日
置信度4

价格

2 个指标

输入价格$1.00/M#113 / 186输出价格$4.05/M#114 / 186
输入价格
Input price
站内排名#113
分数$1.00/M
更新时间2026年9月12日
置信度4
输出价格
Output price
站内排名#114
分数$4.05/M
更新时间2026年9月12日
置信度4

智能体

V3.0

13 个指标 · 正式评分

分数48.6#4280% 区间40.3–56.83/4 实测维度Agentic score57.6#46 / 77Terminal-Bench 2.063.8#27 / 53
维度与证据
规划拆解仅先验
工具调用50.3
2 个基准族 · 2 个指标
mcp_atlas · mcp_atlas · z 0.07 · q 1.00
tau · aa_tau3_banking · z -0.99 · q 1.00
环境与长程执行50
4 个基准族 · 4 个指标
browsecomp · browse_comp · z -0.38 · q 1.00
enterprise_ops_gym · aa_enterprise_ops_gym · z -0.92 · q 1.00
gdpval_aa · benchlm_agentic_gdpval_aa · z 0.00 · q 1.00
terminalbench · benchlm_agentic_terminal_bench2 · z 0.00 · q 1.00
恢复与完成可靠性45.4
1 个基准族 · 1 个指标
briefcase · aa_briefcase_elo · z -1.27 · q 1.00
Agentic score
站内排名#46
分数57.6
更新时间2026年9月12日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#27
分数63.8
更新时间2026年9月12日
置信度4
BrowseCompV3 计分证据
站内排名#20
分数77.1
更新时间2026年9月12日
置信度4
MCP AtlasV3 计分证据
站内排名#15
分数74.1
更新时间2026年9月12日
置信度4
Design Arena Agentic Web Dev
站内排名#1
分数1257.0
更新时间2026年9月12日
置信度4
AA Agentic Index
站内排名#38
分数24.3
更新时间2026年9月12日
置信度4
GDPval-AA
站内排名#35
分数33.3
更新时间2026年9月12日
置信度4
GDPval-AAV3 计分证据
站内排名#36
分数1165.0
更新时间2026年9月12日
置信度4
AA EnterpriseOps-GymV3 计分证据
站内排名#15
分数38.0
更新时间2026年9月12日
置信度4
Terminal-Bench 2.1 (Vals)
站内排名#38
分数47.6
更新时间2026年9月12日
置信度4
AA-AnalystAgent
站内排名#13
分数23.8
更新时间2026年9月12日
置信度4
AA BriefcaseV3 计分证据
站内排名#18
分数844.0
更新时间2026年9月3日
置信度3
AA Tau3 BankingV3 计分证据
站内排名#19
分数29.1
更新时间2026年9月3日
置信度3

代码

V3.0

11 个指标 · 正式评分

分数47.9#2980% 区间41.0–54.74/4 实测维度SciCode47.0%#41 / 89Coding score49.0#58 / 87
维度与证据
代码生成54
1 个基准族 · 1 个指标
scicode · scicode · z 0.37 · q 1.00
仓库工程45.6
1 个基准族 · 1 个指标
swe_pro · swe_pro · z -0.49 · q 1.00
调试与测试51.3
1 个基准族 · 1 个指标
swe_verified · swe_verified · z 0.16 · q 1.00
工具化开发与质量40.6
1 个基准族 · 2 个指标
terminalbench · aa_terminal_bench21 · z -2.74 · q 1.00
terminalbench · benchlm_coding_terminal_bench2 · z -0.24 · q 1.00
SciCodeV3 计分证据
站内排名#41
分数47.0%
更新时间2026年9月12日
置信度4
Coding score
站内排名#58
分数49.0
更新时间2026年9月12日
置信度4
SWE-bench VerifiedV3 计分证据
站内排名#23
分数77.6
更新时间2026年9月12日
置信度4
SWE-bench ProV3 计分证据
站内排名#38
分数54.3
更新时间2026年9月12日
置信度4
Terminal-Bench 2.0V3 计分证据
站内排名#23
分数63.8
更新时间2026年9月12日
置信度4
AA Coding Index
站内排名#44
分数52.1
更新时间2026年9月12日
置信度4
AA-SciCodeV3 计分证据
站内排名#47
分数47.0
更新时间2026年9月12日
置信度4
FrontierSWE v2
站内排名#11
分数4.1
更新时间2026年9月12日
置信度4
LiveCodeBench (Vals)
站内排名#22
分数85.5
更新时间2026年9月12日
置信度4
SWE-bench (Vals)
站内排名#25
分数77.6
更新时间2026年9月12日
置信度4
AA Terminal-Bench 2.1V3 计分证据
站内排名#20
分数55.1
更新时间2026年9月3日
置信度3

综合推理

V3.0

5 个指标 · 估算

分数55.280% 区间44.4–66.02/4 实测维度GPQA87.2%#53 / 218HLE31.9%#52 / 216
维度与证据
抽象逻辑仅先验
科学与因果推理55.9
3 个基准族 · 4 个指标
critpt · critpt · z 0.22 · q 1.00
gpqa · gpqa · z 0.62 · q 1.00
hle · hle · z 0.64 · q 1.00
hle · hle_no_tools · z -1.50 · q 1.00
多步约束仅先验
证据整合与验证54.5
1 个基准族 · 1 个指标
lcr · lcr · z 0.25 · q 1.00
GPQAV3 计分证据
站内排名#53
分数87.2%
更新时间2026年9月12日
置信度4
HLEV3 计分证据
站内排名#52
分数31.9%
更新时间2026年9月12日
置信度4
AA-LCRV3 计分证据
站内排名#41
分数77.3
更新时间2026年9月12日
置信度4
CritPtV3 计分证据
站内排名#45
分数5.4
更新时间2026年9月12日
置信度4
Reasoning score
站内排名#26
分数74.1
更新时间2026年9月12日
置信度4

知识

V3.0

12 个指标 · 暂定评分

分数51.380% 区间37.3–65.31/4 实测维度Knowledge score65.1#52 / 83GPQA-D87.9#24 / 32
维度与证据
广泛知识51.3
2 个基准族 · 2 个指标
aa_omniscience · aa_omniscience_index · z 0.19 · q 1.00
benchlm_category_knowledge · benchlm_category_knowledge · z -0.27 · q 1.00
专业知识仅先验
事实性仅先验
检索与开放资料运用仅先验
Knowledge scoreV3 计分证据
站内排名#52
分数65.1
更新时间2026年9月12日
置信度4
GPQA-D
站内排名#24
分数87.9
更新时间2026年9月12日
置信度4
HLE w/o tools
站内排名#20
分数30.0
更新时间2026年9月12日
置信度4
Artificial Analysis Intelligence IndexV3 计分证据
站内排名#63
分数25.5
更新时间2026年9月12日
置信度4
AA-GPQA Diamond
站内排名#49
分数87.2
更新时间2026年9月12日
置信度4
AA-HLE
站内排名#45
分数31.9
更新时间2026年9月12日
置信度4
AA-Omniscience IndexV3 计分证据
站内排名#37
分数2.0
更新时间2026年9月12日
置信度4
AA-Omniscience Accuracy
站内排名#30
分数41.6
更新时间2026年9月12日
置信度4
AA-Omniscience Hallucination Rate
站内排名#58
分数67.7
更新时间2026年9月12日
置信度4
GPQA Diamond (Vals)
站内排名#27
分数87.1
更新时间2026年9月12日
置信度4
MMLU-Pro (Vals)
站内排名#28
分数86.3
更新时间2026年9月12日
置信度4
AA Openness Index
站内排名#4
分数38.9
更新时间2026年9月4日
置信度3

数学

V3.0

2 个指标 · 暂定评分

分数65.480% 区间49.0–81.71/4 实测维度Math score78.9#10 / 63AIME2697.1#2 / 14
维度与证据
基础数学仅先验
竞赛数学65.4
1 个基准族 · 1 个指标
aime · aime2026 · z 2.05 · q 1.00
高阶证明仅先验
应用与工具辅助数学仅先验
Math score
站内排名#10
分数78.9
更新时间2026年9月12日
置信度4
AIME26V3 计分证据
站内排名#2
分数97.1
更新时间2026年9月12日
置信度4

多语言

V3.0

0 个指标 · 暂无数据

暂无数据80% 区间30.8–69.20/4 实测维度
维度与证据
跨语言理解仅先验
多语言生成仅先验
推理迁移仅先验
低资源鲁棒性仅先验

多模态

V3.0

6 个指标 · 估算

分数45.780% 区间33.8–57.62/4 实测维度Multimodal Grounded score49.2#49 / 56MMMU-Pro73.5#28 / 31
维度与证据
感知与 OCR仅先验
文档与空间理解49.4
1 个基准族 · 1 个指标
charxiv · charxiv · z 0.07 · q 1.00
视觉推理42
1 个基准族 · 1 个指标
mmmu_pro · mmmu_pro · z -1.13 · q 1.00
视频与落地行动仅先验
Multimodal Grounded score
站内排名#49
分数49.2
更新时间2026年9月12日
置信度4
MMMU-ProV3 计分证据
站内排名#28
分数73.5
更新时间2026年9月12日
置信度4
CharXivV3 计分证据
站内排名#14
分数82.0
更新时间2026年9月12日
置信度4
CharXiv w/o tools
站内排名#8
分数78.1
更新时间2026年9月12日
置信度4
AA-MMMU-Pro
站内排名#41
分数73.5
更新时间2026年9月12日
置信度4
Design Arena Website
站内排名#44
分数1226.0
更新时间2026年9月12日
置信度4

指令遵循

V3.0

2 个指标 · 暂定评分

分数56.480% 区间40.4–72.41/4 实测维度Instruction Following score85.2#32 / 52IFBench79.8#4 / 14
维度与证据
约束遵循仅先验
结构化输出仅先验
新指令泛化56.4
1 个基准族 · 1 个指标
ifbench · if_bench · z 0.57 · q 1.00
多轮与长指令仅先验
Instruction Following score
站内排名#32
分数85.2
更新时间2026年9月12日
置信度4
IFBenchV3 计分证据
站内排名#4
分数79.8
更新时间2026年9月12日
置信度4

OpenRouter 端点

3 个端点

来自 OpenRouter 的第三方端点数据,和 LMSpeed 自测数据分开展示。部分 30 分钟实时性能字段需要配置 OpenRouter API key 后同步才会出现。

Provider endpoint输入输出1 天在线率30m 延迟30m 吞吐上下文 / 输出
BaseTen
baseten/fp8
$1/M$4.05/M99.8%undefined tokens / undefined tokens
Together
together
$1/M$4.05/M98.5%undefined tokens / undefined tokens
DeepInfra
deepinfra/fp8
$0.950/M$4.05/M93.3%undefined tokens / undefined tokens

价格对比

对比 Inkling 在 21 家服务商的 API 价格。价格从 $0.00000001/request 到 $10273.97/M,其中 Future Hub 提供最低价 $0.00000001/request。

服务商健康度模型变体分组输入 ($/M)输出 ($/M)速度 (t/s)首字延迟检测
L1
100%
thinkingmachines/inkling:free
default
$75.00/M
$75.00/M
L1
99%
thinkingmachines/inkling:free
free
$0.00005/request
-
L1
100%
thinkingmachines/inkling
default
$75.00/M
$75.00/M
L1
99%
thinkingmachines/inkling:free
default
$547.50/M
$547.50/M
L1
68%
thinkingmachines/inkling
default
$75.00/M
$75.00/M
L1
56%
thinkingmachines/inkling:free
default
$75.00/M
$75.00/M
L1
45%
accounts/fireworks/models/inkling
测试专用
$10273.97/M
$10273.97/M
L1
100%
thinkingmachines/inkling:free
default
$75.00/M
$75.00/M
L1
100%
laohuang/thinkingmachines/inkling
default
$0.020/request
-
L1
0%
inkling
openrouter
$0.00000001/request
-
L1
0%
inkling
无限制
$7.30/M
Cache read$1.24/M
$29.57/M
L1
0%
inkling
model
$7.30/M
Cache read$1.24/M
$29.57/M

替代方案与相似模型

常见问题

Inkling 包含哪些基准测试数据?
LMSpeed 会在数据可用时展示 Inkling 的基准测试、API 价格、输出速度、首字延迟和 21 家服务商数据。
Inkling API 价格是多少?
Inkling 在 21 家服务商有价格记录,价格从 $0.00000001/request$10273.97/M。最低价由 Future Hub 提供。
Inkling API 价格表包含什么?
Inkling API 价格表会对比 21 家服务商的输入价格、输出价格、免费额度、速度、首字延迟和近期健康数据。
哪家服务商的 Inkling API 价格最低?
Future Hub 当前提供 Inkling 的最低收录价格:$0.00000001/request,共对比 21 家服务商。
可以同时对比 Inkling API 价格和速度吗?
可以。LMSpeed 会在同一页展示 Inkling API 价格、输出速度、首字延迟和服务商健康数据,方便一起比较成本和性能。
Inkling 的 API 免费吗?
Inkling 目前在 LMSpeed 上没有免费 API 方案,21 家服务商均按 token 计费。

别名

accounts/fireworks/models/inklinginklinginkling-freelaohuang/thinkingmachines/inklingthinkingmachines/inkling

排名基于社区提交的测试数据与定期健康探测,仅供参考,非官方数据。标准基准数据可能包含 BenchLM 等公开来源。

通过 API 获取 LMSpeed 数据

免费

免费的大模型价格、基准测试和服务商数据公开 API

  • 实时价格与可用性
  • 速度与延迟基准测试
  • 300+ 模型,600+ 服务商
  • 每天 1,000 次请求
查看 API 文档