auto-vision
DSH 图片一体化插件:粘贴图片仅进入对话而不直接进入模型请求,并注册 see_image 工具让文本模型通过任意兼容 OpenAI 的视觉 API 按需看图
AI 分析
核心用途是优化图片输入流程,让文本模型通过工具按需调用外部视觉 API 解析图片,节省 Token。适合需要精细控制图片解析时机的用户。
安裝
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:h-k-c/auto-vision說明文件
閱讀完整 README ↗配置 Token
| 视觉平台 | 环境变量 | 免费模型 |
|---|---|---|
| 智谱 BigModel | ZHIPU_API_KEY | GLM-4V-Flash(免费) |
| 魔搭 ModelScope | MODELSCOPE_API_KEY | Qwen3-VL(免费额度) |
| 其他任意 OpenAI 兼容平台 | VISION_API_KEY + VISION_ENDPOINT + VISION_MODEL | 你平台的模型 |
也可以把 Token 写进 ~/.dsh/.credentials.yaml(同名键),效果一样。
export ZHIPU_API_KEY=xxx # 用智谱
export MODELSCOPE_API_KEY=xxx # 用魔搭