NormanFxxkingRockwell/dsh-auto-vision ↗★ 1
dsh-auto-vision
DeepSeek Harness 视觉桥:自动发现你已配置的多模态模型,给纯文本主模型装上 vision 工具,识别结果以纯文本返回。零配置,一条命令安装。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:NormanFxxkingRockwell/dsh-auto-vision说明文档
阅读完整 README ↗配置
以下配置都是可选的,不配置也能用(自动发现)。
在 plugins 层配置(改 cordis.patch.yml 或 preset 行)
| 配置项 | 说明 |
|---|---|
provider + model | 手动指定视觉模型(两个必须成对给出)。启动时会校验它确实支持图片,否则报错 |
prefer | 自动发现时优先尝试的 provider 顺序,例如 prefer: [bailian] |
discovery: false | 关闭自动发现(此时必须手动指定 provider/model,否则插件报错) |
示例:
### 在 plugins 层配置(改 cordis.patch.yml 或 preset 行)
| 配置项 | 说明 |
|---|---|
| `provider` + `model` | 手动指定视觉模型(两个必须成对给出)。启动时会校验它确实支持图片,否则报错 |
| `prefer` | 自动发现时优先尝试的 provider 顺序,例如 `prefer: [bailian]` |
| `discovery: false` | 关闭自动发现(此时必须手动指定 provider/model,否则插件报错) |
示例:
```yaml
# 在你的 profile 的 cordis.patch.yml 里覆盖插件配置
- id: dsh-auto-vision
config:
provider: bailian
model: qwen3.7-plus
给模型声明图片输入
自动发现靠的是「模型声明了 image 模态」。在 settings.yaml 里给支持图片的模型声明:
providers:
bailian:
models:
- id: qwen3.7-plus
name: Qwen3.7-Plus
contextWindow: 100000
input: [text, image]
功能与兼容性
- 工具名
vision,参数:file_path(必填,支持 PNG / JPEG / WebP / GIF)、instruction(可选,识别要求) - 与
read_image共用同一套附件管线和大小限制 - 启动时会预检:手动指定的模型不支持图片、或自动发现落空,都会在启动时就报出可操作的错误,而不是等你调用时才崩
- 零运行时依赖:不依赖任何 npm 包,只用宿主服务
License
MIT