Zhuchen00123/dsh-compaction-cacheaware ↗★ 0
dsh-compaction-cacheaware
适用于 DSH 的缓存感知压缩后端:通过压缩比例、结构化摘要检查点和稳定的近期尾部消息来增强基础压缩机制。
AI 分析
核心用途是优化长对话的上下文压缩,提高缓存命中率并减少 Token 浪费。适合频繁进行超长对话、关注推理成本的用户。
安装
此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗
说明文档
阅读完整 README ↗Configuration
| Key | Default | Meaning |
|---|---|---|
compactRatio | 0.85 | Sole automatic trigger fraction. |
checkpointCeilingRatio | 0.5 | Normal auto-checkpoint acceptance ceiling. |
recentTailRatio | 0.1 | Recent verbatim tail fraction. |
recentTailMinTokens | 32768 | Lower bound for production tail. |
recentTailMaxTokens | 98304 | Upper bound for production tail. |
summaryMaxTokens | 16384 | Summarizer output cap. |
exceptionalMinSavingsRatio | 0.25 | Required savings when fixed prefix exceeds ceiling. |
minRecentKeep | 2 | Minimum recent messages kept. |
minCompactMessages | 2 | Minimum compactable messages. |
maxPinnedFirstUserTokens | 1500 | Pin first user turn if ≤ this. |
pinnedFirstUserWindowFrac | 0.15 | First-user pin window fraction cap. |
protocolReserveTokens | 256 | Framing reserve. |
summarizationProvider / summarizationModel | '' | Optional summary route; defaults to conversation route. |
auto | true | Register automatic pressure/overflow listeners. |