Tleon-H/dsh-prompt-prefill ↗★ 0
dsh-prompt-prefill
DeepSeek Harness 插件:Agent 回答结束后在输入框预填一条灰色的下一句建议,按 Tab 或 → 采纳;输入框为空时按 ↑ 填入上一次发送的内容。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:Tleon-H/dsh-prompt-prefill说明文档
阅读完整 README ↗配置
写在 cordis.patch.yml 里(profile 的补丁层同样可以覆盖):
| 键 | 默认值 | 说明 |
|---|---|---|
enabled | true | 总开关。关闭后 → 和 ↑ 都不生效。 |
provider / model | '' | 生成提示词固定用的模型,两项都填才生效;留空则跟随当前会话。 |
maxOutputTokens | 512 | 单次生成的最大输出 token 数。 |
timeoutMs | 20000 | 单次生成的超时(毫秒)。 |
maxRecentTurns | 3 | 发给模型的最近消息条数(你和助手各算一条)。 |
maxContextChars | 4000 | 发给模型的对话文字总字数上限。 |
maxCandidateChars | 1200 | 单条提示词的字数上限,超出截断。 |
useFallback | false | 生成失败时是否改为显示兜底句。默认关闭:宁可不显示,也不给千篇一律的话。 |
fallbackPrompts | 三条中文 | useFallback 打开时轮换使用的兜底句。 |
用哪个模型生成提示词
默认依次尝试:
- 配置里填的
provider+model; - 这个会话最近一次实际使用的模型;
- DSH 的默认模型。
复用的是你在 DSH 里配置好的模型和密钥,插件自己不需要任何凭据,浏览器也接触不到密钥。
调用时会请求「关闭思考」(reasoningEffort: 'off'),让提示词又快又便宜。模型不支持这个参数时(例如实测的 workbuddy/glm-5.3-flash),会自动去掉它重试一次。
建议固定一个模型的情况:
- 装了会自动切换主对话模型的插件(例如 dsh-router-laya):不固定的话,提示词会跟着上一轮被切换到的模型走,速度和成功率不稳定。
- 当前聊天模型是关不掉思考的推理模型:思考过程可能用光
maxOutputTokens,正文为空。
选一个响应快、不带思考的模型即可,例如:
provider: 'workbuddy'
model: 'glm-5.3-flash'
发给模型的内容只有最近几条对话的文字,发送前会把 sk-… 形式的密钥、api_key / token / password / secret 字段和 Bearer … 替换成「[已隐藏]」。这种按格式识别的脱敏不能保证认出所有敏感信息。