342949145/dsh-vision-bridge1

dsh-vision-bridge

DSH 识图桥接插件:让 DeepSeek 等纯文本模型会话也能发送图片——图片在进入模型前自动交给外部视觉模型(阿里云百炼 qwen-vl)识别,识别结果以文字形式喂给当前模型。

包名
dsh-vision-bridge
版本
1.0.0
许可证
MIT
最近更新
2026年8月16日

安装

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:342949145/dsh-vision-bridge

配置

配置优先级:环境变量 > 插件目录 .env > VISION_SKILL_DIR 指向目录的 .env / vision.js

变量必填默认说明
DASHSCOPE_API_KEY阿里云百炼 API Key(申请
DASHSCOPE_BASE_URLhttps://dashscope.aliyuncs.com/compatible-mode/v1OpenAI 兼容端点
VISION_MODELqwen-vl-max视觉模型(如 qwen-vl-plusqwen3.7-flash-2026-07-15
VISION_FALLBACK_MODELSqwen-vl-plus,qwen3.7-flash-2026-07-15主模型失败时的回退列表(网络错误/限流/5xx 自动回退,认证与参数错误不重试)
VISION_PROMPT请用中文简洁描述这张图片的内容。识图提示词
VISION_MAX_TOKENS256识别结果长度上限
VISION_MAX_EDGE512图片压缩最长边(像素)
VISION_JPEG_QUALITY80图片压缩质量
VISION_PROVIDERSopencode-go,deepseek-official,deepseek接管哪些纯文本 provider(逗号分隔;opencode-go 为 pi-ai 实际路由,deepseek-official 为官方 DeepSeek 适配器路由)
VISION_CACHEtrue识别结果缓存(内存 + 落盘 %DSH_HOME%/storages/,跨会话/重启复用)
VISION_GEN_MODELqwen-image文生图模型(generate_image 工具)
VISION_GEN_SIZE1024x1024文生图尺寸(1024x1024 / 720x1280 / 1280x720
VISION_SKILL_DIR复用 claude-vision-skill 配置的目录;自动读取其 .env / vision.js 中的 Key 与模型,无需重复填写

与内置 dsh-tool-vision 的图片桥冲突(重要):新版 DSH 内置插件 dsh-tool-vision 默认开启 bridgeTextOnly 图片桥(挂在 agent/pre-step 钩子),会把会话日志里的顶层 image替换成文本提示[User sent an image…, exported to: …]),结果是 GUI 永远不渲染图片、本插件的 generate_image 生成图也看不到。若 DSH 启用了 dsh-tool-vision,必须在 %DSH_HOME%/settings.yamltool-vision 段设置 bridgeTextOnly: false(settings.yaml 被 chokidar 实时监听,改动无需重启即热生效)。关闭后识图转换由本插件在 adapter.stream 层完成:日志保留 image 块(GUI 正常显示),发给模型的请求仍是纯文本。

最小配置示例(复制 .env.example.env):

DASHSCOPE_API_KEY=sk-xxxxxxxx

本插件不包含任何真实 API Key 或本机路径,可安全开源;请通过 .env(已在 .gitignore 中)或环境变量提供配置。

设置页集成:插件注册了 dsh-vision-bridge 设置命名空间(%DSH_HOME%/settings.yaml),DSH 设置页可编辑;运行时优先级:设置页 > 环境变量 > .env > claude-vision-skill。