wjling/dsh-vision-assist0

dsh-vision-assist

DeepSeek Harness 视觉助手插件:给没有视觉能力的模型配一个可随时切换的多模态识别模型。输入框图片自动落盘并改写为文本提示,主模型调用 vision_recognize 工具即可完成看图;识别模型在 settings 的 vision-assist 命名空间热更新切换。

包名
dsh-vision-assist
版本
1.0.0
许可证
MIT
最近更新
2026年9月2日

安装

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:wjling/dsh-vision-assist

配置

方式一:DSH 设置页(推荐)——设置 → 插件 → 可配置标签页 → "视觉助手 vision-assist" 卡片:

  • 启用识别接管(总开关)
  • 识别模型 provider(如 codemaker
  • 识别模型 model(如 gemini-3.7-flash
  • 识别超时(毫秒,1000–600000)

方式二:settings.yaml(热更新,两种方式写的是同一份配置):

vision-assist:
  enabled: true          # 总开关,false 时工具与图片改写都停用
  provider: codemaker    # 识别模型所在 provider(需在 llm-pi-ai 中配置)
  model: gemini-3.7-flash  # 识别模型 id
  timeoutMs: 120000      # 单次识别超时(毫秒)

要求:选定的模型在 llm-pi-ai.providers. .models 中声明了 input: [text, image](未声明的模型会被 DSH 视为纯文本而拒绝图片)。