contextgate
DSH 上下文折叠门插件,拦截 LLM 请求流并将超长对话历史折叠为摘要,控制上下文长度。
AI 分析
核心用途是控制长对话的 Token 消耗。适合频繁进行超长会话、希望自动压缩历史记录以节省费用并维持模型专注度的用户。
安装
此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗
说明文档
阅读完整 README ↗配置
在 apply(ctx) 开头的 CONFIG 对象中调整:
| 配置项 | 默认值 | 说明 |
|---|---|---|
enabled | true | 总开关 |
thresholdTokens | 12000 | 估算 token 超过此值才触发 |
keepHead | 1 | 保留开头 N 条消息(通常是任务陈述) |
keepRecent | 8 | 保留最近 N 条消息 |
gatekeeper.enabled | true | 是否启用 LLM gatekeeper(false = 始终规则折叠) |
gatekeeper.model | undefined | 显式指定 gatekeeper 模型;未指定时自动选择(优先 flash/light/lite/mini/turbo,回退当前模型) |
gatekeeper.confidence | 0.85 | 高置信阈值:drop 项最低置信度 ≥ 此值才自动折叠 |
gatekeeper.maxTokens | 800 | gatekeeper 输出上限 |
gatekeeper.timeoutMs | 15000 | gatekeeper 调用超时(超时回退规则折叠) |
gatekeeper.truncate | 150 | 每条候选消息发送给 gatekeeper 前的截断字符数 |
gatekeeper.askHuman | true | 低置信时询问用户;false = 低置信直接按规则折叠 |