zhangzhimou78-code/deepseek-visual-plugin ↗★ 0

deepseek-visual-plugin

DeepSeek Harness 视觉理解插件:把用户消息与工具结果中的图片翻译成文字描述,交给纯文本任务模型(如 DeepSeek)。 适合使用纯文本模型但需理解图片的用户,需配置视觉模型与密钥。

패키지
deepseek-visual-plugin
호환성
미검증
Cordis peer 범위
*
버전
1.0.0
라이선스
MIT
최근 업데이트
2026. 8. 20.

설치

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:zhangzhimou78-code/deepseek-visual-plugin

配置

cordis.patch.yml 已用默认值挂载该行。可调参数:

字段默认值说明
modelqwen3.7-plus视觉模型名(OpenAI 兼容端点上的模型 ID)
baseUrlDashScope 兼容端点留空时回退 QWEN_BASE_URL / DASHSCOPE_BASE_URL / OPENAI_BASE_URL
apiKey空API Key 的显式覆盖(可选,不推荐明文写进配置)
apiKeyEnv空凭证引用名(如 DOUBAO_API_KEY),通过 dsh 的 credentials 服务(~/.dsh/.credentials.yaml)解析
imagePrompt内置中文提示词图片描述提示词
timeoutMs60000单次视觉请求超时

API Key 的解析优先级:config.apiKey(显式覆盖)→ config.apiKeyEnv(credentials 服务解析 ~/.dsh/.credentials.yaml)→ 环境变量回退(QWEN_API_KEY / DASHSCOPE_API_KEY / OPENAI_API_KEY)。

推荐做法:把 key 存进 ~/.dsh/.credentials.yaml,配置里只写 apiKeyEnv 引用,避免明文密钥落在配置文件里: