CharlesLiuZC/dsh-voice-context ↗★ 0

dsh-voice-context

Voice-to-text for DeepSeek Harness: a composer mic button backed by a cloud STT provider (SiliconFlow) or a bundled offline backend (FunASR / faster-whisper). 适合习惯通过语音输入草稿,并需要灵活切换云端或本地转写服务的用户。

패키지
dsh-voice-context
호환성
미검증
버전
1.0.0
최근 업데이트
2026. 10. 2.

설치

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:CharlesLiuZC/dsh-voice-context

使用

  1. 点输入框左侧的 麦克风 → 说话 → 再点一次停止;转写文本自动追加到当前草稿。
  2. 在 设置 → 语音输入 里选择处理方式:
    • 云端 API:填 SILICONFLOW_API_KEY(写入 DSH 凭据域,不落响应、不回显)。
    • 本地离线:无需密钥,走本机 127.0.0.1:8000 的后端。

首次使用建议先选一种方式,麦克风会按该选择逐次转写。

配置

在 profile 的 cordis.patch.yml 里覆盖 voice-context 行(默认值见下):

- id: voice-context
  name: 'dsh-voice-context'
  config:
    baseUrl: https://api.siliconflow.cn   # OpenAI 兼容 STT 服务地址
    model: FunAudioLLM/SenseVoiceSmall    # 云端默认模型
    language: zh                          # 语言提示
    localPort: 8000                       # 本地后端端口
    pythonBin: python                     # 本地后端使用的 Python
    apiKeyEnv: SILICONFLOW_API_KEY        # 凭据引用名
    maxBytes: 26214400                    # 音频上限(字节)
    timeoutMs: 60000                      # 上游超时