dsh-vision
DeepSeek Harness识图插件。为Agent注册图片分析工具,支持将本地图片或URL发送给兼容OpenAI的视觉模型(默认Gemini 3.7 Flash)并返回文字分析结果。
AI 分析
适合需要处理图像分析、UI界面检查或视觉问答任务的用户。通过为Agent赋能视觉识别能力,扩展了DSH在多模态场景下的应用。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:joyiok/dsh-vision说明文档
阅读完整 README ↗使用
用户:看看 ~/Documents/memory-panel-preview.png 的 UI 有没有问题?
Agent:调用 image_analyze(images: ["/home/joy/Documents/memory-panel-preview.png"],
question: "检查这张界面截图的视觉设计和可用性问题")
工具参数:
| 参数 | 说明 |
|---|---|
images | 必填,本地路径 / http(s) URL / data URL 数组,最多 4 张 |
question | 可选,分析问题;默认详细描述 + UI 问题检查 |
model | 可选,覆盖默认视觉模型 |
maxTokens | 可选,默认 2000 |
配置
可在 profile 的 cordis.patch.yml 覆盖(覆盖整行 config):
- id: vision
config:
apiKeyEnv: OPENROUTER_API_KEY
model: google/gemini-3.7-flash
baseUrl: https://openrouter.ai/api/v1/chat/completions
maxTokens: 2000
timeoutMs: 180000
maxImages: 4
maxImageBytes: 20971520
禁用插件:
- id: vision
disabled: true