jonah791/dsh-prompt-defense ↗★ 0
dsh-prompt-defense
防提示词注入与 LLM 防御体系:外部内容标记 + 注入特征检测 + 危险动作人审门控 + 审计侧车 适合需要检测外部注入攻击、审计高危操作以提升大模型交互安全性的场景。
Install
This plugin has no verified bundle, or compatibility checks failed. Read the repository notes first. Read the full README ↗
README
Read the full README ↗配置
| 项 | 默认 | 说明 |
|---|---|---|
enabled | true | 总开关。false 时 apply() 直接返回——不注册任何钩子(零开销退出) |
tagExternal | true | 是否给外部内容插 [UNTRUSTED-EXTERNAL-CONTENT] 头。关掉只保留检测与审计(不改变内容形状) |
observeDanger | true | 污点存在时是否观测高危动作并落审计。它只记录,不拦截;关掉则连记录都不做 |
taintThreshold | 6 | 置污点的累计分阈值(单条命中权重 3–5)。调低更敏感;调高更宽松、漏检风险上升 |
tracePath | prompt-defense-trace.jsonl | 审计侧车路径。相对路径解析到 ${DSH_HOME}/ 下;绝对路径原样使用 |
默认值取自
src/index.ts的Configschema(z.object),不抄旧文档。
排障建议:怀疑误报时,先看轨迹里的 injection-hit.needle 到底匹配了什么——证据先于调参。误报不会阻塞任何工作(本插件不拦),但会污染污点状态,仍应修掉并转成回归夹具。