C-4-C-4/dsh-vision-bridge ↗★ 0
dsh-vision-bridge
DeepSeek Harness 视觉桥接插件,通过对接用户配置的兼容 OpenAI 或 Google Gemini 的视觉模型 API,为仅支持文本的 DeepSeek 模型赋予图像理解能力。
AI 分析
适合需要处理图像输入但受限于 DeepSeek 纯文本模型的用户。必要条件是需自行配置第三方兼容的视觉模型 API 密钥及端点。
安裝
此插件尚未提供可驗證的 bundle,或相容性檢查未通過。請先閱讀倉庫說明。 閱讀完整 README ↗
說明文件
閱讀完整 README ↗安装到 DSH 配置文件
-
将整个包复制到配置文件的 node_modules 中,例如默认的
web配置:cp -r dsh-vision-bridge "$DSH_HOME"/profiles/web/node_modules/dsh-vision-bridge(
$DSH_HOME通常为~/.dsh,例如C:\Users\你的用户名\.dsh。) -
在该配置文件的
cordis.patch.yml(与cordis.yml同级、在每次 bundle 层之后应用的文件)中注册插件行。追加一条insert条目——单行即可同时激活两端:主机加载器加载lib/index.js(Node 端),dsh-client-modules拾取dsh.client声明并向浏览器提供lib/client.js:# $DSH_HOME/profiles/web/cordis.patch.yml - insert: - id: vision-bridge name: 'dsh-vision-bridge'注意:主机
webServer行(@deepseek-ai/dsh-host-webserver)必须已在配置文件中挂载(出厂的 web-app bundle 中已包含)。不要重复添加webServer行。 -
重启 DSH(
dsh --profile web)并打开 Web UI。
使用方法
- 打开 设置 → 插件 → 插件配置 → 展开 识图插件(Vision Bridge),填写:
- 接口风格:OpenAI 兼容 或 Google Gemini
- API 地址:只需填基础地址即可——
/chat/completions(OpenAI 风格,如https://open.bigmodel.cn/api/paas/v4)或:generateContent(Gemini)会自动追加 - API 密钥、模型名称(例如
glm-4v-flash、glm-4.6v、gpt-4o-mini、qwen-vl-max、gemini-2.0-flash) - 识别提示词(可选;默认会请求一段详细的中文描述)
- 点击"保存",然后点击"测试连接"验证。
- 点击回形针按钮(或将图片拖到聊天区域任意位置)。图片会被缩放为 ≤1280px 的 JPEG 并自动发送到视觉 API。
- 预览卡片会显示状态;展开"识别结果"查看完整文本,然后点击"插入并发送"将其交给 DeepSeek,或先点击"插入输入框"进行编辑。
- 在对话过程中,DeepSeek 自身也可以调用
vision_lookup工具来询问已上传图片的信息。