NagasakiSoyo-ui/dsh-llm-deepseek-vision ↗★ 1
@deepseek-ai/dsh-llm-deepseek-vision
Vision-augmented DeepSeek adapter plugin for DeepSeek Harness: a vision-capable model describes image input, then a text-only DeepSeek model reasons over the description
AI Analysis
核心用途是为不支持视觉的 DeepSeek 推理模型曲线实现“看图”能力。适合需要对图片进行深度逻辑推理的复杂多模态任务。
Install
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:NagasakiSoyo-ui/dsh-llm-deepseek-visionREADME
Read the full README ↗2. 在组合配置中挂载
在 Harness 的插件组合配置(如 profile 的 cordis.patch.yml)中添加:
- id: llm-deepseek-vision
name: '@deepseek-ai/dsh-llm-deepseek-vision'
config:
# 提供视觉模型的 provider 路由
visionProvider: opencode-go
# 该路由上的视觉模型 id —— 即"眼睛"
visionModel: mimo-v2.5
# 给视觉模型的指令
visionPrompt: 'Describe the attached image in detail…'
# 单次视觉描述的输出上限
visionMaxTokens: 1024
# 实际进行推理的纯文本路由
delegateProvider: opencode-go
# 该路由对外广告的模型目录;默认镜像 DeepSeek 目录
models:
- id: deepseek-v4-flash
name: DeepSeek-V4-Flash
contextWindow: 1000000
- id: deepseek-v4-pro
name: DeepSeek-V4-Pro
contextWindow: 1000000
4. 使用 / Usage
在模型选择器中选 DeepSeek (Vision) 和一个模型 id(deepseek-v4-flash / deepseek-v4-pro),然后在消息中附加图片。想设为会话默认,把 agent-default-model 指向它:
agent-default-model:
provider: deepseek-vision
model: deepseek-v4-flash
配置项 / Configuration reference
| 字段 | 默认值 | 说明 |
|---|---|---|
visionProvider | opencode-go | 提供视觉模型的 provider 路由 |
visionModel | mimo-v2.5 | 视觉模型 id(必须支持 [text, image] 输入) |
visionPrompt | 内置默认提示词 | 给视觉模型的描述指令 |
visionMaxTokens | 无 | 单次视觉描述输出上限 |
delegateProvider | opencode-go | 接收文字请求并推理的路由 |
models | DeepSeek 目录镜像 | 该路由广告的模型目录 |