dsh-rapid-ocr-ui
Dual-face (host + client) plugin: independent text-output ocr_image tool + tools/execute read_image capability dispatch + ctx.ocr seam, with a conversation.input.left OCR toggle button.
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:kid-tea/dsh-rapid-ocr-ui说明文档
阅读完整 README ↗使用
- 重启后,纯文本会话里贴一张图;
- Agent 的提示词已被告知:提取文字用
ocr_image(file_path); - 也可以手动打开输入栏左侧的「OCR 模式」开关,按需对图做 OCR。
配置项
| 字段 | 默认值 | 含义 |
|---|---|---|
enabled | true | 总开关;false 时插件什么都不注册 |
provider | none | OCR 后端:none / tesseract / rapidocr / paddleocr-json / paddleocr-py |
ocrPath | — | 引擎可执行文件/脚本路径(provider 相关) |
modelPath | — | 模型/语言数据目录(provider 相关) |
language | ch | OCR 语言,如 ch / en / ch,en |
maxImageBytes | 20000000 | 单图送入 OCR 的字节上限 |
timeoutMs | 60000 | OCR 调用超时 |
scope | agent | 工具注册平面:agent(推荐)或 global |
fallbackOnly | true | 图片能力路由始终优先原生 read_image |
autoOcrImages | false | 打开 OCR 模式后是否自动 OCR 新附件 |
injectOcrText | false | 是否自动把 OCR 文本插入草稿 |
promptSectionOrder | 118 | 「图片 → 用 ocr_image」提示词段顺序 |