dsh-ocr-local
Local OCR fallback for DeepSeek Harness (Web): when the routed model cannot accept image input, a pasted image is saved locally and its text read by PP-OCRv5 + ONNX Runtime — fully offline, no vision model required. / DeepSeek Harness 本地 OCR 兜底插件(Web):当接入的模型不支持图片输入时,自动把图片存到本地并用 PP-OCRv5 读出文字,完全离线。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:grelvan/dsh-ocr-local说明文档
阅读完整 README ↗第 3 步:开始使用
方式 A:粘贴截图(最常用)
在 Web 输入框里按 Ctrl+V / Cmd+V。图片走浏览器原生的附件流程进入会话, 之后按上面的表自动分流:纯文本模型 → 本插件兜底;多模态模型 → 模型直接看图。
方式 B:告诉 agent 图片路径
把图片文件的绝对路径发给 agent,说「识别这张图片」。
配置(可选,默认不用动)
配置文件:~/.dsh/profiles/web/cordis.patch.yml
- insert:
- id: ocr
name: 'dsh-ocr-local'
config:
autoOcr: true # 见下表
pythonPath: ~/miniconda3/envs/ocr/bin/python # 可选:指定 Python
modelDir: ~/.dsh-ocr/models # 可选:模型目录
maxCacheFiles: 300 # 可选:图片缓存最多文件数
maxCacheAgeDays: 30 # 可选:图片缓存保留天数
autoOcr 三态:
| 值 | 行为 |
|---|---|
true(默认) | 自动判定:只有模型明确不支持图片输入时才介入 |
false | 完全关闭自动介入。仍可手动让模型调 ocr_image |
'always' | 无条件介入(即使模型能看图也注入提示)。旧版 0.3.x 的行为,排查问题时可用 |
常用环境变量:
| 变量 | 作用 |
|---|---|
DSH_OCR_MODELS_MIRROR | 模型下载镜像前缀(国内下载慢时设,如 https://ghproxy.com/) |
DSH_OCR_PYTHON | 指定 OCR 用哪个 Python(默认自动找) |
DSH_OCR_MODELS | 模型存放目录(默认 ~/.dsh-ocr/models) |