Icestab/dsh-image-vision-bridge ↗★ 0
dsh-image-vision-bridge
DSH 主机插件,自动将用户发送的图片路由至视觉模型(如 mimo-v2.5)生成文本描述,再隐式喂给主文本模型,不破坏聊天记录。
AI 分析
核心用途是为不支持多模态的纯文本大模型(如 DeepSeek-V3/R1)曲线救国地增加“看图”能力。适合希望在使用纯文本强力模型时,也能直接发送图片进行讨论的用户。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:Icestab/dsh-image-vision-bridge说明文档
阅读完整 README ↗配置
| 键 | 默认值 | 说明 |
|---|---|---|
enabled | true | false 时完全透传,不做桥接 |
provider | opencode-go | 视觉模型所在 LLM 路由(必须已注册,即 settings.yaml 里 llm-pi-ai.providers 已配置) |
model | mimo-v2.5 | 视觉模型 id |
maxTokens | 2048 | 视觉调用最大输出 token |
maxDescriptionChars | 6000 | 注入主模型前的描述长度上限 |
prompt | 内置中文提示词 | 发给视觉模型的指令(用户原文会自动拼在前面) |
示例(自定义):
- insert:
- id: image-vision-bridge
name: 'dsh-image-vision-bridge'
config:
model: mimo-v2.5
maxTokens: 4096
prompt: 'Describe this image in English, including all visible text.'