vexpaer/ContextGate1

contextgate

DSH 上下文折叠门插件,拦截 LLM 请求流并将超长对话历史折叠为摘要,控制上下文长度。

AI 分析

核心用途是控制长对话的 Token 消耗。适合频繁进行超长会话、希望自动压缩历史记录以节省费用并维持模型专注度的用户。

包名
contextgate
版本
1.0.0
许可证
MIT
最近更新
2026年8月13日

安装

此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗

配置

apply(ctx) 开头的 CONFIG 对象中调整:

配置项默认值说明
enabledtrue总开关
thresholdTokens12000估算 token 超过此值才触发
keepHead1保留开头 N 条消息(通常是任务陈述)
keepRecent8保留最近 N 条消息
gatekeeper.enabledtrue是否启用 LLM gatekeeper(false = 始终规则折叠)
gatekeeper.modelundefined显式指定 gatekeeper 模型;未指定时自动选择(优先 flash/light/lite/mini/turbo,回退当前模型)
gatekeeper.confidence0.85高置信阈值:drop 项最低置信度 ≥ 此值才自动折叠
gatekeeper.maxTokens800gatekeeper 输出上限
gatekeeper.timeoutMs15000gatekeeper 调用超时(超时回退规则折叠)
gatekeeper.truncate150每条候选消息发送给 gatekeeper 前的截断字符数
gatekeeper.askHumantrue低置信时询问用户;false = 低置信直接按规则折叠