NagasakiSoyo-ui/dsh-llm-deepseek-vision1

@deepseek-ai/dsh-llm-deepseek-vision

Vision-augmented DeepSeek adapter plugin for DeepSeek Harness: a vision-capable model describes image input, then a text-only DeepSeek model reasons over the description

AI Analysis

核心用途是为不支持视觉的 DeepSeek 推理模型曲线实现“看图”能力。适合需要对图片进行深度逻辑推理的复杂多模态任务。

Package
@deepseek-ai/dsh-llm-deepseek-vision
Version
0.1.0-rc.5
License
MIT
Last updated
Aug 14, 2026

Install

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:NagasakiSoyo-ui/dsh-llm-deepseek-vision

2. 在组合配置中挂载

在 Harness 的插件组合配置(如 profile 的 cordis.patch.yml)中添加:

- id: llm-deepseek-vision
  name: '@deepseek-ai/dsh-llm-deepseek-vision'
  config:
    # 提供视觉模型的 provider 路由
    visionProvider: opencode-go
    # 该路由上的视觉模型 id —— 即"眼睛"
    visionModel: mimo-v2.5
    # 给视觉模型的指令
    visionPrompt: 'Describe the attached image in detail…'
    # 单次视觉描述的输出上限
    visionMaxTokens: 1024
    # 实际进行推理的纯文本路由
    delegateProvider: opencode-go
    # 该路由对外广告的模型目录;默认镜像 DeepSeek 目录
    models:
      - id: deepseek-v4-flash
        name: DeepSeek-V4-Flash
        contextWindow: 1000000
      - id: deepseek-v4-pro
        name: DeepSeek-V4-Pro
        contextWindow: 1000000

4. 使用 / Usage

在模型选择器中选 DeepSeek (Vision) 和一个模型 id(deepseek-v4-flash / deepseek-v4-pro),然后在消息中附加图片。想设为会话默认,把 agent-default-model 指向它:

agent-default-model:
  provider: deepseek-vision
  model: deepseek-v4-flash

配置项 / Configuration reference

字段默认值说明
visionProvideropencode-go提供视觉模型的 provider 路由
visionModelmimo-v2.5视觉模型 id(必须支持 [text, image] 输入)
visionPrompt内置默认提示词给视觉模型的描述指令
visionMaxTokens单次视觉描述输出上限
delegateProvideropencode-go接收文字请求并推理的路由
modelsDeepSeek 目录镜像该路由广告的模型目录