shuxu-zhao/dsh-image-dscriber0

dsh-image-describer

Giving text models eyes to see in DeepSeek Harness.

包名
dsh-image-describer
版本
0.1.0
许可证
MIT
最近更新
2026年8月18日

安装

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:shuxu-zhao/dsh-image-dscriber

⚙️ Configuration

Configure the plugin in your profile's cordis.patch.yml:

- insert:
    - id: image-describer-tool
      name: dsh-image-describer
      inject: [tools, llm, attachments]
      config:
        provider: minimax-cn       # Multimodal provider route
        model: MiniMax-M3          # Vision model ID (must support image input)
        maxTokens: 2048            # Max output tokens per description
        timeoutMs: 60000           # Timeout in milliseconds
OptionTypeDefaultDescription
providerstringminimax-cnVision model provider route (configure API key in settings.yaml)
modelstringMiniMax-M3Vision model ID (must support image input)
promptstringChinese detailed promptDefault prompt used when caller doesn't specify a specific question
maxTokensnumber2048Max output tokens per analysis
timeoutMsnumber60000Analysis timeout in milliseconds

⚙️ 配置项说明

在 Profile 的 cordis.patch.yml 中进行声明或覆盖:

- insert:
    - id: image-describer-tool
      name: dsh-image-describer
      inject: [tools, llm, attachments]
      config:
        provider: minimax-cn       # 多模态提供方路由
        model: MiniMax-M3          # 视觉模型 ID(必须支持图片输入)
        maxTokens: 2048            # 单次图片分析的最大 Token 上限
        timeoutMs: 60000           # 单次图片分析超时时间(毫秒)
配置字段类型默认值说明
providerstringminimax-cn视觉描述者 Provider 路由(需在 settings.yaml 中配置 API Key)
modelstringMiniMax-M3视觉描述者模型 ID(必须为支持图像输入的多模态模型)
promptstring中文详细描述模板默认分析提示词模板(当调用方未指定具体问题时使用)
maxTokensnumber2048单次图片分析的最大输出 Token 上限
timeoutMsnumber60000单次图片分析的超时时间(毫秒)