C-4-C-4/dsh-vision-bridge0

dsh-vision-bridge

DeepSeek Harness 视觉桥接插件,通过对接用户配置的兼容 OpenAI 或 Google Gemini 的视觉模型 API,为仅支持文本的 DeepSeek 模型赋予图像理解能力。

AI 分析

适合需要处理图像输入但受限于 DeepSeek 纯文本模型的用户。必要条件是需自行配置第三方兼容的视觉模型 API 密钥及端点。

包名
dsh-vision-bridge
版本
0.1.0
许可证
MIT
最近更新
2026年8月15日

安装

此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗

安装到 DSH 配置文件

  1. 将整个包复制到配置文件的 node_modules 中,例如默认的 web 配置:

    cp -r dsh-vision-bridge "$DSH_HOME"/profiles/web/node_modules/dsh-vision-bridge
    

    $DSH_HOME 通常为 ~/.dsh,例如 C:\Users\你的用户名\.dsh。)

  2. 在该配置文件的 cordis.patch.yml(与 cordis.yml 同级、在每次 bundle 层之后应用的文件)中注册插件行。追加一条 insert 条目——单行即可同时激活两端:主机加载器加载 lib/index.js(Node 端),dsh-client-modules 拾取 dsh.client 声明并向浏览器提供 lib/client.js

    # $DSH_HOME/profiles/web/cordis.patch.yml
    - insert:
        - id: vision-bridge
          name: 'dsh-vision-bridge'
    

    注意:主机 webServer 行(@deepseek-ai/dsh-host-webserver)必须已在配置文件中挂载(出厂的 web-app bundle 中已包含)。不要重复添加 webServer 行。

  3. 重启 DSH(dsh --profile web)并打开 Web UI。

使用方法

  1. 打开 设置 → 插件 → 插件配置 → 展开 识图插件(Vision Bridge),填写:
    • 接口风格:OpenAI 兼容 或 Google Gemini
    • API 地址:只需填基础地址即可——/chat/completions(OpenAI 风格,如 https://open.bigmodel.cn/api/paas/v4)或 :generateContent(Gemini)会自动追加
    • API 密钥、模型名称(例如 glm-4v-flashglm-4.6vgpt-4o-miniqwen-vl-maxgemini-2.0-flash
    • 识别提示词(可选;默认会请求一段详细的中文描述)
    • 点击"保存",然后点击"测试连接"验证。
  2. 点击回形针按钮(或将图片拖到聊天区域任意位置)。图片会被缩放为 ≤1280px 的 JPEG 并自动发送到视觉 API。
  3. 预览卡片会显示状态;展开"识别结果"查看完整文本,然后点击"插入并发送"将其交给 DeepSeek,或先点击"插入输入框"进行编辑。
  4. 在对话过程中,DeepSeek 自身也可以调用 vision_lookup 工具来询问已上传图片的信息。