Xieweikang123/dsh-vision-bridge ↗★ 1

dsh-vision-bridge

为纯文本模型接入视觉端点,粘贴图片自动转文字。 适合用纯文本模型但需识别图片的用户,需配置视觉 API。

套件
dsh-vision-bridge
相容性
待驗證
Cordis 依賴範圍
^4.0.1
版本
0.1.0
授權
MIT
最近更新
2026年8月14日

同名套件的其他儲存庫

安裝

此插件尚未提供可驗證的 bundle,或相容性檢查未通過。請先閱讀倉庫說明。 閱讀完整 README ↗

配置识别用的 API key

默认走智谱免费档 glm-4.6v-flash,只需一个 key:

  1. 到 注册并创建 API key。
  2. 把 key 写进 ~/.dsh/.env:VISION_API_KEY=

key 读取顺序:config.apiKey → $VISION_API_KEY → $DSH_VISION_API_KEY → $ZHIPUAI_API_KEY → $DASHSCOPE_API_KEY。本地 Ollama 端点可免 key。

重启 dsh 后生效:粘贴一张图,发送,模型就能看懂它。


配置

插件支持以下 config 项(在 cordis.patch.yml 的对应条目加 config: 即可):

- insert:
    - id: dsh-vision-bridge
      name: 'file:///D:/project/dsh-vision-bridge/lib/index.js'
      config:
        baseURL: https://open.bigmodel.cn/api/paas/v4   # OpenAI 兼容端点
        apiKey: ""                                       # 留空则读环境变量
        model: glm-4.6v-flash                             # 视觉模型
        fallbackModels: []                                # 自定义降级链;空则默认智谱免费链
        prompt: ""                                        # 自定义识别提示词
        maxTokens: 2048
        timeoutMs: 60000

后端速查

场景baseURLmodel
默认(智谱免费)https://open.bigmodel.cn/api/paas/v4glm-4.6v-flash
智谱付费同上glm-4.6v
阿里百炼https://dashscope.aliyuncs.com/compatible-mode/v1qwen3-vl-flash
火山豆包https://ark.cn-beijing.volces.com/api/v3doubao-seed-2-1-turbo-260628
本地 Ollamahttp://localhost:11434/v1qwen3-vl:4b(无需 key)