Xieweikang123/dsh-vision-bridge ↗★ 1

dsh-vision-bridge

Give a text-only dsh model eyes: pasted images are recognized into text via an OpenAI-compatible vision endpoint (Zhipu free by default) before the message reaches the model. 适合用纯文本模型但需识别图片的用户,需配置视觉 API。

パッケージ
dsh-vision-bridge
互換性
未検証
Cordis ピア範囲
^4.0.1
バージョン
0.1.0
ライセンス
MIT
最終更新
2026/08/14

同名パッケージの別リポジトリ

インストール

検証済み bundle がないか、互換性チェックに失敗しています。先にリポジトリの説明を読んでください。 README 全文を読む ↗

ドキュメント

README 全文を読む ↗

配置识别用的 API key

默认走智谱免费档 glm-4.6v-flash,只需一个 key:

  1. 到 注册并创建 API key。
  2. 把 key 写进 ~/.dsh/.env:VISION_API_KEY=

key 读取顺序:config.apiKey → $VISION_API_KEY → $DSH_VISION_API_KEY → $ZHIPUAI_API_KEY → $DASHSCOPE_API_KEY。本地 Ollama 端点可免 key。

重启 dsh 后生效:粘贴一张图,发送,模型就能看懂它。


配置

插件支持以下 config 项(在 cordis.patch.yml 的对应条目加 config: 即可):

- insert:
    - id: dsh-vision-bridge
      name: 'file:///D:/project/dsh-vision-bridge/lib/index.js'
      config:
        baseURL: https://open.bigmodel.cn/api/paas/v4   # OpenAI 兼容端点
        apiKey: ""                                       # 留空则读环境变量
        model: glm-4.6v-flash                             # 视觉模型
        fallbackModels: []                                # 自定义降级链;空则默认智谱免费链
        prompt: ""                                        # 自定义识别提示词
        maxTokens: 2048
        timeoutMs: 60000

后端速查

场景baseURLmodel
默认(智谱免费)https://open.bigmodel.cn/api/paas/v4glm-4.6v-flash
智谱付费同上glm-4.6v
阿里百炼https://dashscope.aliyuncs.com/compatible-mode/v1qwen3-vl-flash
火山豆包https://ark.cn-beijing.volces.com/api/v3doubao-seed-2-1-turbo-260628
本地 Ollamahttp://localhost:11434/v1qwen3-vl:4b(无需 key)