maxwell-feng/dsh-tesseract-ocr ↗★ 2
@maxwell-feng/dsh-tesseract-ocr
DSH 本地 OCR 插件:利用 Tesseract 在本地识别上传的图片,仅将识别出的文本发送给模型,避免文本模型接收图片字节。
AI 分析
核心用途是让不支持多模态的纯文本模型也能“看懂”图片中的文字。适合希望节省 Vision 模型 Token 消耗,或在本地离线处理图片文字识别任务的用户。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:maxwell-feng/dsh-tesseract-ocr说明文档
阅读完整 README ↗Configuration
All settings live in the patch row tesseract-ocr:
| Key | Default | Meaning |
|---|---|---|
language | eng | Tesseract language(s), +-joined, e.g. eng, chi_sim, eng+chi_sim |
passthrough | false | false (default): OCR every image. true: genuine vision models receive images untouched |
tesseractBin | tesseract | CLI path; quote paths with spaces, e.g. "C:\Program Files\Tesseract-OCR\tesseract.exe" |
psm | 3 | Page segmentation mode (tesseract --psm) |
timeoutMs | 60000 | Per-image OCR timeout |
maxCacheEntries | 200 | Bound on the per-run OCR cache (keyed by attachment id) |