shuxu-zhao/dsh-image-dscriber0

dsh-image-describer

为 DeepSeek Harness 中的文本模型提供视觉能力的插件。

AI 分析

核心用途是通过配置多模态视觉模型(如 MiniMax-M3)为纯文本模型提供图像描述能力。适合需要在不支持视觉的文本模型会话中处理图片输入的用户。需在配置文件中配置提供商和模型。

套件
dsh-image-describer
版本
0.1.0
授權
MIT
最近更新
2026年8月18日

安裝

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:shuxu-zhao/dsh-image-dscriber

⚙️ Configuration

Configure the plugin in your profile's cordis.patch.yml:

- insert:
    - id: image-describer-tool
      name: dsh-image-describer
      inject: [tools, llm, attachments]
      config:
        provider: minimax-cn       # Multimodal provider route
        model: MiniMax-M3          # Vision model ID (must support image input)
        maxTokens: 2048            # Max output tokens per description
        timeoutMs: 60000           # Timeout in milliseconds
OptionTypeDefaultDescription
providerstringminimax-cnVision model provider route (configure API key in settings.yaml)
modelstringMiniMax-M3Vision model ID (must support image input)
promptstringChinese detailed promptDefault prompt used when caller doesn't specify a specific question
maxTokensnumber2048Max output tokens per analysis
timeoutMsnumber60000Analysis timeout in milliseconds

⚙️ 配置项说明

在 Profile 的 cordis.patch.yml 中进行声明或覆盖:

- insert:
    - id: image-describer-tool
      name: dsh-image-describer
      inject: [tools, llm, attachments]
      config:
        provider: minimax-cn       # 多模态提供方路由
        model: MiniMax-M3          # 视觉模型 ID(必须支持图片输入)
        maxTokens: 2048            # 单次图片分析的最大 Token 上限
        timeoutMs: 60000           # 单次图片分析超时时间(毫秒)
配置字段类型默认值说明
providerstringminimax-cn视觉描述者 Provider 路由(需在 settings.yaml 中配置 API Key)
modelstringMiniMax-M3视觉描述者模型 ID(必须为支持图像输入的多模态模型)
promptstring中文详细描述模板默认分析提示词模板(当调用方未指定具体问题时使用)
maxTokensnumber2048单次图片分析的最大输出 Token 上限
timeoutMsnumber60000单次图片分析的超时时间(毫秒)