jonah791/dsh-prompt-defense ↗★ 0

dsh-prompt-defense

防提示词注入与 LLM 防御体系:外部内容标记 + 注入特征检测 + 危险动作人审门控 + 审计侧车 适合需要检测外部注入攻击、审计高危操作以提升大模型交互安全性的场景。

パッケージ
dsh-prompt-defense
互換性
未検証
Harness ピア範囲
^0.1.0-rc.6
Cordis ピア範囲
^4.0.1
バージョン
0.1.0
ライセンス
MIT
最終更新
2026/09/16

インストール

検証済み bundle がないか、互換性チェックに失敗しています。先にリポジトリの説明を読んでください。 README 全文を読む ↗

ドキュメント

README 全文を読む ↗

配置

项默认说明
enabledtrue总开关。false 时 apply() 直接返回——不注册任何钩子(零开销退出)
tagExternaltrue是否给外部内容插 [UNTRUSTED-EXTERNAL-CONTENT] 头。关掉只保留检测与审计(不改变内容形状)
observeDangertrue污点存在时是否观测高危动作并落审计。它只记录,不拦截;关掉则连记录都不做
taintThreshold6置污点的累计分阈值(单条命中权重 3–5)。调低更敏感;调高更宽松、漏检风险上升
tracePathprompt-defense-trace.jsonl审计侧车路径。相对路径解析到 ${DSH_HOME}/ 下;绝对路径原样使用

默认值取自 src/index.ts 的 Config schema(z.object),不抄旧文档。

排障建议:怀疑误报时,先看轨迹里的 injection-hit.needle 到底匹配了什么——证据先于调参。误报不会阻塞任何工作(本插件不拦),但会污染污点状态,仍应修掉并转成回归夹具。