dsh-tts
Text-to-speech for dsh web: speaks each assistant reply out loud using Edge TTS neural voices (host bridge + browser player)
安装
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:Vim0x3c/dsh-tts说明文档
阅读完整 README ↗dsh-tts
English | 中文
dsh web 的语音播报插件:把每个助手答复的最终结果用 Edge TTS(微软神经语音)朗读出来,实现开口即答的语音交流。
- 真·Edge TTS:宿主(Node)端用微软 Edge “大声朗读” 神经语音接口在线合成 MP3,浏览器播放 —— 无需 OpenAI/第三方密钥,免费。握手用自实现的 RFC 6455 WebSocket(Node 原生 WebSocket / undici 会过滤微软必需的握手头导致升级被拒,手动握手实测返回 101)。
- 只读最终结果:中间步骤、工具调用说明不读;每个回合只朗读收尾那条最终答复;连续多回合只读最新一条。长回复自动按句子分段串行朗读。自动朗读失败会降级到浏览器本地
speechSynthesis(离线也能出声)。 - 音色/语速:内置
zh-CN-XiaoxiaoNeural等 20+ 个 Edge 神经音色,滑块调语速 (0.5×–2×)。 - 喇叭开关:输入框工具排的喇叭按钮(悬停有提示)快速开关「自动朗读新回复」;关闭时立即中断当前朗读。设置里与「自动朗读新回复」联动。
- 审批提示:遇到「需要审批」时朗读“需要审批”,可单独关闭;可自定义审批提示音(预设「叮/哔哔/咚」或用 Web Audio/上传 mp3/wav/ogg ≤1MB,选定即时试听)。
- 完全本地、零运行时依赖:Edge 协议用 Node 内置 API 原生实现,插件本体不含任何第三方 npm 依赖,离线也能安装。
dsh-plugin topic: (https://github.com/topics/dsh-plugin)
默认音色
zh-CN-XiaoxiaoNeural(晓晓)。如需更多官方音色,自行在src/voices.ts里追加 EdgeShortName即可。
设置界面

安装
前置要求:dsh 的应用闭包需包含插件的
@deepseek-ai/dsh-*peer 包——即任何带@deepseek-ai/dsh-web-appbundle 的部署(dsh web官方 profile 都满足)。
方式一:本地构建 tarball 后安装(最常用)
本项目当前以源码仓库形式发布,没有已构建的 release
tgz。你要先在仓库里构建出dsh-tts-0.1.0.tgz,再通过它安装。
-
克隆/进入仓库并构建:
git clone https://github.com/Vim0x3c/dsh-tts.git dsh-tts cd dsh-tts pnpm install pnpm build # tsdown:产出 lib/index.js、lib/client.js 等 npm pack # 生成 dsh-tts-0.1.0.tgz若你只想在本机用,也可以直接在仓库根执行
pnpm build拿到lib/;但安装到 dsh 建议用 tarball(npm pack生成)。 -
安装到 web profile: