dsh-vision-helper
Deployment-level vision plugin for DeepSeek Harness: registers the vision_analyze tool backed by a configurable multimodal model, with a settings-page UI. Zero dependencies.
安装
此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗
说明文档
阅读完整 README ↗dsh-vision-helper
English | 中文
为 DeepSeek Harness 打造的部署级视觉插件。
注册 vision_analyze 工具,让智能体通过任意可配置的多模态模型分析图片(OCR、UI/报错截图、图表理解、通用图片描述),并在 Web 应用中提供设置页界面。
零依赖设计 —— 宿主模块没有任何 import,安装只需复制文件夹 + 一行补丁配置。无需 npm install、无需修改 node_modules 结构、无需软链接。
功能特性
vision_analyze工具 —— 接受本地图片路径或data:URI,发送给配置的多模态模型,返回分析文字。- 可配置模型 —— 在「设置 → 视觉助手」中选择提供方与模型(或直接编辑
$DSH_HOME/dsh-vision-helper.json);留空自动选择多模态模型。 - 健壮性 —— 自动剥离粘贴路径中的不可见 Unicode 字符(U+202A 等);按最长边限制图片尺寸(
maxEdge,默认 4096px);去重流式文本;友好的错误提示。 - 自动调用引导 —— 注入系统提示段,让智能体在涉及图片的任务中自动调用
vision_analyze。 - 持久且全局 —— 宿主组合插件:重启不丢失,所有会话可用。
环境要求(使用者侧)
- DSH Web 部署(设置页仅 Web 端;工具本身在挂载了该插件的任何 profile 中均可用)。
- 在部署的
llm-pi-ai设置(「模型」设置页)中配置好多模态模型路由——例如mimo-v2.5,或你添加的任意 OpenAI 兼容视觉端点。插件不携带任何 API Key。
安装
- 将本
dsh-vision-helper文件夹复制到/node_modules/(默认 profile:$HOME/.dsh/profiles/web),使包落在/node_modules/dsh-vision-helper/。 - 在
/cordis.patch.yml中添加插件行:
- insert:
- id: dsh-vision-helper
name: 'dsh-vision-helper'
- 重启
dsh web。完成——无需解析任何依赖,模块完全自包含。
配置
通过设置页(设置 → 视觉助手):提供方、模型、温度、最大输出 tokens、最大图片边长。等效的配置文件位于 $DSH_HOME/dsh-vision-helper.json(与 settings.yaml 同级):
{
"provider": "opencode-go",
"model": "mimo-v2.5",
"temperature": 0.2,
"maxTokens": 1024,
"maxEdge": 4096,
"mode": "auto"
}
provider/model 留空 = 自动选择;maxEdge 限制图片最长边像素。 控制注入智能体系统提示的自动调用引导: