joyiok/dsh-vision0

dsh-vision

DeepSeek Harness识图插件。为Agent注册图片分析工具,支持将本地图片或URL发送给兼容OpenAI的视觉模型(默认Gemini 3.7 Flash)并返回文字分析结果。

AI 分析

适合需要处理图像分析、UI界面检查或视觉问答任务的用户。通过为Agent赋能视觉识别能力,扩展了DSH在多模态场景下的应用。

包名
dsh-vision
版本
0.1.2
许可证
MIT
最近更新
2026年8月15日

安装

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:joyiok/dsh-vision

使用

用户:看看 ~/Documents/memory-panel-preview.png 的 UI 有没有问题?
Agent:调用 image_analyze(images: ["/home/joy/Documents/memory-panel-preview.png"],
       question: "检查这张界面截图的视觉设计和可用性问题")

工具参数:

参数说明
images必填,本地路径 / http(s) URL / data URL 数组,最多 4 张
question可选,分析问题;默认详细描述 + UI 问题检查
model可选,覆盖默认视觉模型
maxTokens可选,默认 2000

配置

可在 profile 的 cordis.patch.yml 覆盖(覆盖整行 config):

- id: vision
  config:
    apiKeyEnv: OPENROUTER_API_KEY
    model: google/gemini-3.7-flash
    baseUrl: https://openrouter.ai/api/v1/chat/completions
    maxTokens: 2000
    timeoutMs: 180000
    maxImages: 4
    maxImageBytes: 20971520

禁用插件:

- id: vision
  disabled: true