这项检测怎么跑
系统提示词泄漏检测,会想办法让隐藏指令出现在模型输出里。LMSpeed 会换几种问法,避免只拒绝一种说法就被当成安全。
01探测
先让模型逐字复述隐藏指令。
02检查
再用翻译和 JSON 续写换一种问法。
03判定
只有隐藏指令出现在输出里,才记为泄漏。
- 结果怎么看
- 拒绝一种问法不算通过。泄漏意味着私有策略或包装话术能被问进普通回答。公开报告会打码。
- 什么时候该跑这一项
- 怀疑中转站带了私有系统提示词时用这项。如果只关心身份或流式,可以先不跑。
最近报告
包含这项检测的公开报告。
常见问题
什么是系统提示词泄漏?
就是隐藏的系统指令出现在可见回答里。泄漏可以是原文、翻译,也可以是 JSON 续写。
模型拒绝回答,就说明没有泄漏吗?
不能。它可能拒绝一种问法,却在另一种问法里泄漏。所以这项检测会用多种探针。
LMSpeed 会公开提取到的提示词吗?
公开报告会打码。你能看到有没有泄漏,但 LMSpeed 不会公开隐藏提示词或你的 API Key。
