@deepseek-ai/dsh-ocr-vision
Model-facing ocr_image tool that runs local RapidOCR (via a Python subprocess) and returns image text as plain text, so text-only DeepSeek models can read images 让纯文本模型读取图片文字,需 Linux 或 macOS、Python 及 OCR 依赖。
インストール
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:QEDQCD/dsh-ocr-visionドキュメント
README 全文を読む ↗使用
模型侧直接调用(或经技能引导):
ocr_image(file_path: "截图.png")
ocr_image(file_path: "截图.png", region: "120,80,600,400") # 只识别关注区域
预期输出(工具返回的纯文本信封):
/workspace/截图.png
ocr
报错码:ERR_DB_CONN_TIMEOUT
关键行:Connection refused -> db.internal:5432 / retry 3/3 failed
配置
ocr_image 插件可通过 cordis 配置调整:
| 字段 | 默认 | 含义 |
|---|---|---|
pythonBin | python3 | 运行 ocr.py 的 Python 解释器 |
ocrScript | 随包 ocr.py | RapidOCR CLI 脚本路径 |
ocrCommand | 空 | 完整命令前缀,覆盖 pythonBin+ocrScript(测试/定制宿主用) |
scale | 2 | 默认放大倍数(小字更准) |
maxImageBytes | 50 MiB | 经 ctx.fs 读取的最大图片字节 |
timeoutMs | 60000 | 单次 OCR 子进程超时 |