342949145/dsh-vision-bridge ↗★ 1
dsh-vision-bridge
DSH 识图桥接插件:让 DeepSeek 等纯文本模型会话也能发送图片——图片在进入模型前自动交给外部视觉模型(阿里云百炼 qwen-vl)识别,识别结果以文字形式喂给当前模型。
安装
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:342949145/dsh-vision-bridge说明文档
阅读完整 README ↗配置
配置优先级:环境变量 > 插件目录 .env > VISION_SKILL_DIR 指向目录的 .env / vision.js。
| 变量 | 必填 | 默认 | 说明 |
|---|---|---|---|
DASHSCOPE_API_KEY | ✅ | — | 阿里云百炼 API Key(申请) |
DASHSCOPE_BASE_URL | https://dashscope.aliyuncs.com/compatible-mode/v1 | OpenAI 兼容端点 | |
VISION_MODEL | qwen-vl-max | 视觉模型(如 qwen-vl-plus、qwen3.7-flash-2026-07-15) | |
VISION_FALLBACK_MODELS | qwen-vl-plus,qwen3.7-flash-2026-07-15 | 主模型失败时的回退列表(网络错误/限流/5xx 自动回退,认证与参数错误不重试) | |
VISION_PROMPT | 请用中文简洁描述这张图片的内容。 | 识图提示词 | |
VISION_MAX_TOKENS | 256 | 识别结果长度上限 | |
VISION_MAX_EDGE | 512 | 图片压缩最长边(像素) | |
VISION_JPEG_QUALITY | 80 | 图片压缩质量 | |
VISION_PROVIDERS | opencode-go,deepseek-official,deepseek | 接管哪些纯文本 provider(逗号分隔;opencode-go 为 pi-ai 实际路由,deepseek-official 为官方 DeepSeek 适配器路由) | |
VISION_CACHE | true | 识别结果缓存(内存 + 落盘 %DSH_HOME%/storages/,跨会话/重启复用) | |
VISION_GEN_MODEL | qwen-image | 文生图模型(generate_image 工具) | |
VISION_GEN_SIZE | 1024x1024 | 文生图尺寸(1024x1024 / 720x1280 / 1280x720) | |
VISION_SKILL_DIR | — | 复用 claude-vision-skill 配置的目录;自动读取其 .env / vision.js 中的 Key 与模型,无需重复填写 |
与内置
dsh-tool-vision的图片桥冲突(重要):新版 DSH 内置插件dsh-tool-vision默认开启bridgeTextOnly图片桥(挂在agent/pre-step钩子),会把会话日志里的顶层image块替换成文本提示([User sent an image…, exported to: …]),结果是 GUI 永远不渲染图片、本插件的generate_image生成图也看不到。若 DSH 启用了dsh-tool-vision,必须在%DSH_HOME%/settings.yaml的tool-vision段设置bridgeTextOnly: false(settings.yaml 被 chokidar 实时监听,改动无需重启即热生效)。关闭后识图转换由本插件在adapter.stream层完成:日志保留image块(GUI 正常显示),发给模型的请求仍是纯文本。
最小配置示例(复制 .env.example 为 .env):
DASHSCOPE_API_KEY=sk-xxxxxxxx
本插件不包含任何真实 API Key 或本机路径,可安全开源;请通过
.env(已在.gitignore中)或环境变量提供配置。设置页集成:插件注册了
dsh-vision-bridge设置命名空间(%DSH_HOME%/settings.yaml),DSH 设置页可编辑;运行时优先级:设置页 > 环境变量 >.env> claude-vision-skill。