JollY-Life/jolly-dsh-vision ↗★ 0
jolly-dsh-vision
ModLens-style vision bridge for DeepSeek Harness: deepseek-v4-pro as the brain, deepseek-v4-flash-vision-exp as the eyes.
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:JollY-Life/jolly-dsh-vision说明文档
阅读完整 README ↗配置
默认值在 cordis.patch.yml,均可覆盖:
| 键 | 默认值 | 含义 |
|---|---|---|
provider | deepseek-official | 眼睛模型所在的路由 |
model | deepseek-v4-flash-vision-exp | 眼睛模型 id |
toolName | vision | 暴露给大脑的工具名 |
maxImageBytes | 20971520 (20MB) | 单张图片大小上限 |
timeoutMs | 120000 | 一次眼睛调用的协作式超时 |
maxOutputTokens | 8192 | 证据输出上限 |
visionProvider | true | 注册 (ds vision) 视觉孪生路由 |
wrapperProvider | deepseek-vision | 孪生路由 id(模型选择器里的分组) |
sourceProvider | deepseek-official | 被包裹的上游路由(其纯文本模型生成孪生) |
twinSuffix | (ds vision) | 孪生模型名后缀 |
evidenceCacheMax | 128 | 每图证据缓存容量(按 attachmentId 去重) |
guide | true | 给大脑加系统提示词引导区段 |
allowPrivateUrls | false | false 时拒绝私有/环回/链路本地 URL(SSRF 防护) |
使用
通路 A:路径/URL + vision 工具
- 给大脑一张图:本地绝对/相对路径,或 http(s) URL,可带关注点。
- 引导区段会让大脑在该调
vision时调用它;大脑基于 OCR 全文与布局作答,看不清的地方会出现在 uncertainty 里。
通路 B:直接贴图 + (ds vision) 孪生模型
- 在模型选择器里选带
(ds vision)后缀的条目。 - 直接在输入框粘贴/拖入图片——准入检查通过,缩略图正常显示。
- 请求发出前,插件自动把图片转成证据文本(带
[Attached image, converted to evidence by the jolly-dsh-vision bridge]标记)注入给大脑;大脑按引导直接引用,不会重复调用工具。 - 同一张图在一次会话内只转换一次(附件内容寻址 + 缓存);转换失败会降级为恒定占位文本并继续对话,细节留在 harness 日志。
注意:模型选择器里的"普通版"纯文本模型依然不接受贴图——想要贴图就选带
(ds vision)后缀的条目。