lhenlihai-hub/dsh-voice-input ↗★ 1
dsh-voice-input
Voice dictation and transcript cleanup for DeepSeek Harness, using the current session model.
安装
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:lhenlihai-hub/dsh-voice-input说明文档
阅读完整 README ↗dsh-voice-input
面向 DeepSeek Harness 的开源语音输入插件:把语音转成文字,再调用当前会话已经选择的模型做严格受限的整理,最后写回 Harness 输入框。
它只做两件事:
- 语音输入;
- 删除无意义语气词、口误重复和明确改口,并补充标点、断句。
它不会翻译,也不会回答听写内容。模型路由和凭据完全由 Harness 管理,因此插件没有 API Key 设置。
当前版本:
0.3.0,按 DeepSeek Harness0.1.0-rc.6的 Host、Client Modules、Slot 与 Typert 接口构建。
功能
- 在官方
conversation.input.left插槽中添加麦克风和设置按钮; - 优先使用浏览器的
SpeechRecognition / webkitSpeechRecognition; - 浏览器不支持时回退到系统听写:macOS 使用
Fn×2,Windows 使用Win+H; - 默认快捷键为
Ctrl+Alt+V,支持自定义组合键或F1–F24; - 支持自动、普通话、繁体中文、粤语、英语、日语和韩语识别;
- 每次整理前读取当前 Session 的模型选择,并使用 Harness 自己的路由和凭据;
- 整理失败时保留原文,整理期间不会覆盖用户的新编辑;
- 根据浏览器语言自动提供中文或英文界面;
- 设置中提供确认后的一键完整卸载。
浏览器插件无法注册操作系统级全局快捷键,所以自定义快捷键只在 Harness 页面处于焦点时生效。
安装
如果旧版或错误版本仍然存在,先移除:
dsh plugin --profile
remove dsh-voice-input
从 GitHub 安装最新版:
dsh plugin --profile
add github:lhenlihai-hub/dsh-voice-input
随后完全退出并重新启动对应的 Harness profile。 替换成实际名称,常见名称是 web。
本地开发安装:
git clone https://github.com/lhenlihai-hub/dsh-voice-input.git
cd dsh-voice-input
npm install
npm test
cd ..
dsh plugin --profile
add ./dsh-voice-input
也可以安装 tarball:
npm run pack:plugin
dsh plugin --profile
add ./dsh-voice-input-0.3.0.tgz
使用
- 点击麦克风或按
Ctrl+Alt+V; - 说话,再次点击或按快捷键停止;
- 插件用当前会话模型整理转写文字并写回输入框;
- 在旁边的设置中修改快捷键或识别语言。
进入系统听写回退时,输入框会自动聚焦。按系统听写快捷键并说话;草稿约 1.2 秒没有变化后自动整理。
整理规则
0.3.0 已完整替换旧提示词,不在旧提示词上增加例外。模型只允许做以下改动:
- 保留信息、主语、人称、语序、措辞、语气、时态、语言和中英文混写;
- 删除没有意义的语气词、口误重复和被明确改口替换的内容;