DDDFXYqiming/dsh-vision-skill1

dsh-vision-skill

DSH 标准视觉技能插件,支持 Qwen 动态分辨率预处理、OpenAI 兼容 VLM 链(含容灾/限流退避)、结构化证据模式、本地 Tesseract 长截图 OCR 及剪贴板粘贴。

AI 分析

核心用途是为 DSH 提供全面的视觉分析与 OCR 工具集。适合需要图像识别、定位、长截图文字提取等视觉任务的用户。内置 8 个工具,支持 MiniMax 等模型配置。

套件
dsh-vision-skill
版本
0.4.4
授權
MIT
最近更新
2026年8月16日

安裝

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:DDDFXYqiming/dsh-vision-skill

配置(覆盖 bundle 默认值)

⚠️ 重要:bundle 方式安装后,不要在 profile 的 cordis.patch.yml 里再 insert 一个 id: vision-skill——重复 id 会导致 duplicate loader entry id 启动崩溃。需要自定义配置时,用裸条目按 id 覆盖(不带 insert: 包装):


## 使用示例

识别这张图 → vision_analyze OCR 这张图 → vision_ocr 在这张图里找到 → vision_ground(返回像素坐标框) 清点这张图的所有按钮 → vision_detect 这张图的主色是什么 → vision_dominant_colors(本地算法,不耗 API) 提取这段长聊天记录的文字 → vision_long_screenshot_ocr 看图(剪贴板截图) → vision_clipboard