JollY-Life/jolly-dsh-vision0

jolly-dsh-vision

ModLens-style vision bridge for DeepSeek Harness: deepseek-v4-pro as the brain, deepseek-v4-flash-vision-exp as the eyes.

包名
jolly-dsh-vision
版本
0.1.0
许可证
MIT
最近更新
2026年8月21日

安装

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:JollY-Life/jolly-dsh-vision

配置

默认值在 cordis.patch.yml,均可覆盖:

默认值含义
providerdeepseek-official眼睛模型所在的路由
modeldeepseek-v4-flash-vision-exp眼睛模型 id
toolNamevision暴露给大脑的工具名
maxImageBytes20971520 (20MB)单张图片大小上限
timeoutMs120000一次眼睛调用的协作式超时
maxOutputTokens8192证据输出上限
visionProvidertrue注册 (ds vision) 视觉孪生路由
wrapperProviderdeepseek-vision孪生路由 id(模型选择器里的分组)
sourceProviderdeepseek-official被包裹的上游路由(其纯文本模型生成孪生)
twinSuffix(ds vision)孪生模型名后缀
evidenceCacheMax128每图证据缓存容量(按 attachmentId 去重)
guidetrue给大脑加系统提示词引导区段
allowPrivateUrlsfalsefalse 时拒绝私有/环回/链路本地 URL(SSRF 防护)

使用

通路 A:路径/URL + vision 工具

  1. 给大脑一张图:本地绝对/相对路径,或 http(s) URL,可带关注点。
  2. 引导区段会让大脑在该调 vision 时调用它;大脑基于 OCR 全文与布局作答,看不清的地方会出现在 uncertainty 里。

通路 B:直接贴图 + (ds vision) 孪生模型

  1. 在模型选择器里选带 (ds vision) 后缀的条目。
  2. 直接在输入框粘贴/拖入图片——准入检查通过,缩略图正常显示。
  3. 请求发出前,插件自动把图片转成证据文本(带 [Attached image, converted to evidence by the jolly-dsh-vision bridge] 标记)注入给大脑;大脑按引导直接引用,不会重复调用工具。
  4. 同一张图在一次会话内只转换一次(附件内容寻址 + 缓存);转换失败会降级为恒定占位文本并继续对话,细节留在 harness 日志。

注意:模型选择器里的"普通版"纯文本模型依然不接受贴图——想要贴图就选带 (ds vision) 后缀的条目。