dsh-vision-assist
DeepSeek Harness 视觉助手插件:给没有视觉能力的模型配一个可随时切换的多模态识别模型。输入框图片自动落盘并改写为文本提示,主模型调用 vision_recognize 工具即可完成看图;识别模型在 settings 的 vision-assist 命名空间热更新切换。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:wjling/dsh-vision-assist说明文档
阅读完整 README ↗配置
方式一:DSH 设置页(推荐)——设置 → 插件 → 可配置标签页 → "视觉助手 vision-assist" 卡片:
- 启用识别接管(总开关)
- 识别模型 provider(如
codemaker) - 识别模型 model(如
gemini-3.7-flash) - 识别超时(毫秒,1000–600000)
方式二:settings.yaml(热更新,两种方式写的是同一份配置):
vision-assist:
enabled: true # 总开关,false 时工具与图片改写都停用
provider: codemaker # 识别模型所在 provider(需在 llm-pi-ai 中配置)
model: gemini-3.7-flash # 识别模型 id
timeoutMs: 120000 # 单次识别超时(毫秒)
要求:选定的模型在 llm-pi-ai.providers. .models 中声明了
input: [text, image](未声明的模型会被 DSH 视为纯文本而拒绝图片)。