zhangzhimou78-code/deepseek-visual-plugin ↗★ 0
deepseek-visual-plugin
把消息与工具结果中的图片转为文字描述,供纯文本模型使用。 适合使用纯文本模型但需理解图片的用户,需配置视觉模型与密钥。
安装
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:zhangzhimou78-code/deepseek-visual-plugin说明文档
阅读完整 README ↗配置
cordis.patch.yml 已用默认值挂载该行。可调参数:
| 字段 | 默认值 | 说明 |
|---|---|---|
model | qwen3.7-plus | 视觉模型名(OpenAI 兼容端点上的模型 ID) |
baseUrl | DashScope 兼容端点 | 留空时回退 QWEN_BASE_URL / DASHSCOPE_BASE_URL / OPENAI_BASE_URL |
apiKey | 空 | API Key 的显式覆盖(可选,不推荐明文写进配置) |
apiKeyEnv | 空 | 凭证引用名(如 DOUBAO_API_KEY),通过 dsh 的 credentials 服务(~/.dsh/.credentials.yaml)解析 |
imagePrompt | 内置中文提示词 | 图片描述提示词 |
timeoutMs | 60000 | 单次视觉请求超时 |
API Key 的解析优先级:config.apiKey(显式覆盖)→ config.apiKeyEnv(credentials 服务解析 ~/.dsh/.credentials.yaml)→ 环境变量回退(QWEN_API_KEY / DASHSCOPE_API_KEY / OPENAI_API_KEY)。
推荐做法:把 key 存进 ~/.dsh/.credentials.yaml,配置里只写 apiKeyEnv 引用,避免明文密钥落在配置文件里: