dsh-pdf
PDF toolbox for DeepSeek Harness: extract text, metadata, and page ranges from PDF files (local parsing, no API key).
AI 分析
核心用途是让 AI 能够直接读取和分析本地 PDF 文档。适合需要对 PDF 论文、合同或报告进行总结、问答的用户。无需联网或第三方 API 密钥,完全本地解析。
インストール
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:sunshine-lang/dsh-pdfドキュメント
README 全文を読む ↗使用方法
启动 Web UI 后,向模型提问,例如:
读取
paper.pdf的前 3 页并总结。
contract.pdf第 7 页写了什么?
模型会调用 pdf_read:参数 path(必填),可选 pages("1-3,5" 或 "all")。输出达到上限时会在页边界截断并给出提示,模型会用页码范围继续读取。
配置
可通过 cordis.patch.yml 或 profile 的 patch 层覆盖任意配置项:
- patch:
- id: dsh-pdf
config:
maxFileBytes: 52428800
maxPages: 200
maxCharsPerCall: 20000
| 配置项 | 默认值 | 含义 |
|---|---|---|
maxFileBytes | 20971520(20 MiB) | 整个 PDF 的字节上限(含);超过直接报错 |
maxPages | 500 | 单次调用最多解析的页数;超出则截断并提示 |
maxCharsPerCall | 12000 | 单次调用返回的最大字符数;结果在页边界截断 |
配置无效时插件加载会直接失败,并给出可操作的错误信息。