314857493/dsh-vision--packages-vision-tool ↗★ 1
dsh-vision-free-eyes
DeepSeek Harness 插件:面向模型的 `vision` 工具,通过直接调用免费的智谱 GLM 视觉 API 来描述图片内容并进行 OCR 文字识别。
AI 分析
适合需要让模型自主读取本地图片或提取图中文字的任务。模型可直接调用该工具对指定路径的图片进行 OCR 或内容描述,无需外部 CLI。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:314857493/dsh-vision#20e9851d3da589f3f121871f13c1e324555a8af0&path:packages/vision-tool说明文档
阅读完整 README ↗使用
告诉模型图片路径即可,例如:"看一下 D:\xxx\screenshot.png"。
可选参数:mode="ocr"(只提取图中文字)、no_cache=true(跳过进程内结果缓存)。
输出为图片内容的文字描述,末尾带 [glm | 耗时ms] 标记。
配置
| config | 默认 | 说明 |
|---|---|---|
apiKeyEnv | GLM_API_KEY / ZHIPU_API_KEY | GLM key 的环境变量名(可传数组) |
no_cache | false | 跳过进程内结果缓存,强制重新请求 |