easy-vision
A DeepSeek Harness tool plugin that lets a text-only agent 'see' local images: it reads an image file, auto-detects the real format, and returns (or writes to a Markdown file) a detailed text description produced by a separate OpenAI-compatible vision model.
安装
此插件尚未提供可验证的 bundle,或兼容性检查未通过。请先阅读仓库说明。 阅读完整 README ↗
说明文档
阅读完整 README ↗easy-vision
English · 简体中文
一个 DeepSeek Harness 工具插件,让仅支持文本的智能体能"看懂"本地图片。
它注册一个面向模型(model-facing)的 describe_image 工具。当模型需要查看、描述、分析或识读一张图片(截图、照片、图表、UI 设计稿、Logo 等)时,它会以图片的本地路径调用该工具。插件会:
- 读取文件并通过 魔数(magic bytes)自动识别真实格式(PNG / JPEG / GIF / WebP),即使文件扩展名错误也能正确识别。
- 将图片(base64 data URI)通过 chat completions 发送给配置好的 OpenAI 兼容的视觉模型。
- 返回详细的 文字描述,或者可选地将其写入一个 Markdown 文件。
这让运行在纯文本路由上的模型(例如某个拒绝图片输入的网关上跑的 deepseek)也能通过文字"看到"图片。
使用效果
用自然语言让智能体“看一下”某张图片,describe_image 工具就会把它转换成可用的文字描述——并可选择直接写入 Markdown 文件,用于生成 UI 说明文档、设计稿笔记等。



安装
该包是零依赖的纯 ESM Cordis 插件,只注入 tools。需要先把包装进你的 DSH profile,再在 patch 层进行挂载。
第一步:把安装到 DSH profile
根据你的情况选择来源:
从 npm 安装(发布到 npm 后推荐):
dsh plugin --profile web add easy-vision
等同于在 profile 目录下直接跑 pnpm:
cd "$env:DSH_HOME\profiles\web"
pnpm add easy-vision
从本地 tarball 安装(尚未发布 / 不发布时):
cd "$env:DSH_HOME\profiles\web"
pnpm add "D:\path\to\easy-vision-0.1.0.tgz"
@deepseek-ai/cordis声明为 peer 依赖 —— DSH 已在运行时提供,无需额外安装。
第二步:在 patch 层挂载
将其添加到 DSH patch 文件 —— 例如 home 级 $DSH_HOME\cordis.patch.yml(作用于所有 profile)或某个 profile 的 cordis.patch.yml:
- insert:
- id: easy-vision
name: easy-vision
config:
baseUrl: https://example.com/v1
model: your-vision-model
apiKeyEnv: EASY_VISION_API_KEY
timeoutMs: 120000
保存即可 —— DSH 会热重载 cordis.patch.yml 的改动。新会话即可把 工具暴露给模型。