dsh-vision-mix
A DeepSeek Harness Mix plugin for vision routing plus GPT Image generation and editing.
AI 分析
核心用途是提供统一的 `Mix` 模型入口,自动分发文本、识图及生图/修图请求。适合需要多模型协同处理多模态任务的用户。
インストール
$
npx -p @deepseek-ai/dsh dsh plugin --profile web add github:haiziyao/dsh-vision-mixドキュメント
README 全文を読む ↗2. 配置准备使用的模型
打开“设置 → 模型”,配置至少两个模型:
| 用途 | 要求 | 示例 |
|---|---|---|
| 基础模型 | 能处理文本、推理和工具调用 | deepseek-chat、deepseek-v4-pro |
| 识图模型 | 中转站实际支持 OpenAI/Anthropic 图片消息 | gpt-5.6-sol、其他视觉模型 |
识图和基础模型可以来自同一个 Provider,也可以分别使用不同中转站。
如果还要生成或编辑图片,再配置一个支持 OpenAI-compatible /images/generations 和 /images/edits 的 Provider。它可以使用与识图模型完全不同的 Base URL 和 API Key。
5. 开始使用
新建对话,在模型选择器中选择 Mix,然后尝试:
上传一张图片:这张图里是什么?
下一轮追问:右下角还有什么?
让 Agent 截图:检查当前网页有没有布局问题。
Mix 是 Vision Mix 注册的固定模型入口,不是一个需要单独填写 API Key 的模型服务。
使用独立的图片生成 API
识图模型与图片生成模型不必来自同一个中转站。例如:
| 用途 | Provider | 模型 |
|---|---|---|
| 基础对话 | chat-relay | deepseek-chat |
| 图片识别 | vision-relay | gpt-5.6-sol |
| 图片生成与编辑 | images-relay | gpt-image-2 |
配置步骤:
- 在“设置 → 模型”分别创建识图 Provider 和 Images API Provider。
- 在“模型图片能力”中测试并启用识图模型的
image能力。 - 在上方“基础设置”中选择识图模型。
- 在“图片生成与编辑”选择 Images API Provider。
- 点击“测试生图 API”。测试固定使用
low、1024×1024、PNG,会产生一次实际生图费用。 - 看到测试图预览后点击“保存路由”。
生图测试只在内存中预览并校验结果,不会把测试图片永久写入 attachment 存储。
启用后 Agent 可以调用:
vision_mix_image_generate:根据提示词生成新图片。vision_mix_image_edit:使用当前会话 attachment 编辑用户图片或上一张生成图。
生成结果会作为 DSH attachment 直接显示在对话中。后续可以继续要求“把刚才生成的图改成夜景”。
没有安装 dsh-better-sidebar 能否使用
可以。缺少的只有“识图记录”和“生图记录”入口,核心路由和对话图片显示不受影响。