运行完整 13 步 audit

可用上下文

测试真实的 LLM 上下文窗口

逐步加大上下文,看这个接口实际能保住多少内容。

这项检测怎么跑

LLM 上下文窗口测试,会找出中转站真正能保住多少上下文。宣传中的窗口,可能比截断或静默丢弃后的可用窗口更大。

  1. 01探测

    在逐渐变长的上下文里放入标记。

  2. 02检查

    继续加大,直到接口丢掉或忘掉某个标记。

  3. 03判定

    报告最后一个还能保住标记的长度。

这项检测看什么

LMSpeed 会放入标记,再逐步加大上下文,直到接口保不住这些标记。这个边界就是这个中转站的可用窗口。

为什么要测

如果可用窗口比宣传的小,长对话、RAG 和 Agent 记录就可能丢掉前面的指令,而且还没有明显报错。

宣传 128K 或 200K,仍可能被截断。这项测试会埋入标记,并加大上下文,直到标记消失。买长上下文、做 RAG 或 agent 轨迹前先跑它。测速看不出这种静默丢失。

结果怎么看
可用窗口可能比宣传数字更小。窗口过短,对 RAG 和长 Agent 记录是产品风险,不只是一个参数。
什么时候该跑这一项
买 128K 或 200K 线路前先跑这项。测速看不出静默截断。

最近报告

包含这项检测的公开报告。

常见问题

LLM 上下文窗口测试是做什么的?

它测量中转站真正能保住的上下文,而不只是宣传页上的数字。

为什么真实窗口会更小?

中转站可能截断、摘要或丢掉旧 Token,用来省钱或贴合上游限制。

这能证明官方模型上限吗?

不能。它只证明这次检测时,这个接口的可用窗口。官方模型上限仍可能不同。

其他检测项