运行完整 13 步 audit

系统提示词泄漏

检查系统提示词会不会泄漏

用逐字复述、翻译和 JSON 续写三种探针,测试这个接口。

这项检测怎么跑

系统提示词泄漏检测,会想办法让隐藏指令出现在模型输出里。LMSpeed 会换几种问法,避免只拒绝一种说法就被当成安全。

  1. 01探测

    先让模型逐字复述隐藏指令。

  2. 02检查

    再用翻译和 JSON 续写换一种问法。

  3. 03判定

    只有隐藏指令出现在输出里,才记为泄漏。

这项检测看什么

LMSpeed 会让模型复述、翻译,或用 JSON 续写隐藏指令。如果提取成功,说明隐藏系统提示词没有被隔离好。

为什么要测

如果隐藏提示词能被套出来,中转站的私有策略、品牌话术或路由规则,就可能被任何人问出来。

系统提示词泄漏,和 Token 变多不是一回事。这一项试着把隐藏指令套进可见回答。公开报告会打码,所以你能知道发生了泄漏,又不会公开隐藏文本或 API Key。

结果怎么看
拒绝一种问法不算通过。泄漏意味着私有策略或包装话术能被问进普通回答。公开报告会打码。
什么时候该跑这一项
怀疑中转站带了私有系统提示词时用这项。如果只关心身份或流式,可以先不跑。

最近报告

包含这项检测的公开报告。

常见问题

什么是系统提示词泄漏?

就是隐藏的系统指令出现在可见回答里。泄漏可以是原文、翻译,也可以是 JSON 续写。

模型拒绝回答,就说明没有泄漏吗?

不能。它可能拒绝一种问法,却在另一种问法里泄漏。所以这项检测会用多种探针。

LMSpeed 会公开提取到的提示词吗?

公开报告会打码。你能看到有没有泄漏,但 LMSpeed 不会公开隐藏提示词或你的 API Key。

其他检测项