jonah791/dsh-prompt-defense ↗★ 0

dsh-prompt-defense

防提示词注入与 LLM 防御体系:外部内容标记 + 注入特征检测 + 危险动作人审门控 + 审计侧车 适合需要检测外部注入攻击、审计高危操作以提升大模型交互安全性的场景。

패키지
dsh-prompt-defense
호환성
미검증
Harness peer 범위
^0.1.0-rc.6
Cordis peer 범위
^4.0.1
버전
0.1.0
라이선스
MIT
최근 업데이트
2026. 9. 16.

설치

검증된 bundle이 없거나 호환성 검사에 실패했습니다. 먼저 저장소 설명을 읽어 주세요. 전체 README 읽기 ↗

配置

项默认说明
enabledtrue总开关。false 时 apply() 直接返回——不注册任何钩子(零开销退出)
tagExternaltrue是否给外部内容插 [UNTRUSTED-EXTERNAL-CONTENT] 头。关掉只保留检测与审计(不改变内容形状)
observeDangertrue污点存在时是否观测高危动作并落审计。它只记录,不拦截;关掉则连记录都不做
taintThreshold6置污点的累计分阈值(单条命中权重 3–5)。调低更敏感;调高更宽松、漏检风险上升
tracePathprompt-defense-trace.jsonl审计侧车路径。相对路径解析到 ${DSH_HOME}/ 下;绝对路径原样使用

默认值取自 src/index.ts 的 Config schema(z.object),不抄旧文档。

排障建议:怀疑误报时,先看轨迹里的 injection-hit.needle 到底匹配了什么——证据先于调参。误报不会阻塞任何工作(本插件不拦),但会污染污点状态,仍应修掉并转成回归夹具。