grelvan/dsh-ocr-local6

dsh-ocr-local

DeepSeek Harness 本地 OCR 兜底插件(Web):当模型不支持图片时,自动通过本地 PP-OCRv5 识别图片文字,完全离线

AI 分析

核心用途是为非多模态模型提供本地离线图片文字识别。适合经常需要发送截图但使用纯文本模型对话的用户,首次使用需通过工具自动配置 Python 依赖。

套件
dsh-ocr-local
版本
0.4.0
授權
NOASSERTION
最近更新
2026年9月11日

安裝

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:grelvan/dsh-ocr-local

第 3 步:开始使用

方式 A:粘贴截图(最常用)

在 Web 输入框里按 Ctrl+V / Cmd+V。图片走浏览器原生的附件流程进入会话, 之后按上面的表自动分流:纯文本模型 → 本插件兜底;多模态模型 → 模型直接看图。

方式 B:告诉 agent 图片路径

把图片文件的绝对路径发给 agent,说「识别这张图片」。

配置(可选,默认不用动)

配置文件:~/.dsh/profiles/web/cordis.patch.yml

- insert:
    - id: ocr
      name: 'dsh-ocr-local'
      config:
        autoOcr: true                                   # 见下表
        pythonPath: ~/miniconda3/envs/ocr/bin/python   # 可选:指定 Python
        modelDir: ~/.dsh-ocr/models                     # 可选:模型目录
        maxCacheFiles: 300                              # 可选:图片缓存最多文件数
        maxCacheAgeDays: 30                             # 可选:图片缓存保留天数

autoOcr 三态:

行为
true(默认)自动判定:只有模型明确不支持图片输入时才介入
false完全关闭自动介入。仍可手动让模型调 ocr_image
'always'无条件介入(即使模型能看图也注入提示)。旧版 0.3.x 的行为,排查问题时可用

常用环境变量:

变量作用
DSH_OCR_MODELS_MIRROR模型下载镜像前缀(国内下载慢时设,如 https://ghproxy.com/
DSH_OCR_PYTHON指定 OCR 用哪个 Python(默认自动找)
DSH_OCR_MODELS模型存放目录(默认 ~/.dsh-ocr/models