haiziyao/dsh-vision-mix2

dsh-vision-mix

A DeepSeek Harness Mix plugin for vision routing plus GPT Image generation and editing.

AI 分析

核心用途是提供统一的 `Mix` 模型入口,自动分发文本、识图及生图/修图请求。适合需要多模型协同处理多模态任务的用户。

パッケージ
dsh-vision-mix
バージョン
0.2.2
ライセンス
MIT
最終更新
2026/08/16

インストール

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:haiziyao/dsh-vision-mix

ドキュメント

README 全文を読む ↗

2. 配置准备使用的模型

打开“设置 → 模型”,配置至少两个模型:

用途要求示例
基础模型能处理文本、推理和工具调用deepseek-chatdeepseek-v4-pro
识图模型中转站实际支持 OpenAI/Anthropic 图片消息gpt-5.6-sol、其他视觉模型

识图和基础模型可以来自同一个 Provider,也可以分别使用不同中转站。

如果还要生成或编辑图片,再配置一个支持 OpenAI-compatible /images/generations/images/edits 的 Provider。它可以使用与识图模型完全不同的 Base URL 和 API Key。

5. 开始使用

新建对话,在模型选择器中选择 Mix,然后尝试:

上传一张图片:这张图里是什么?
下一轮追问:右下角还有什么?
让 Agent 截图:检查当前网页有没有布局问题。

Mix 是 Vision Mix 注册的固定模型入口,不是一个需要单独填写 API Key 的模型服务。

使用独立的图片生成 API

识图模型与图片生成模型不必来自同一个中转站。例如:

用途Provider模型
基础对话chat-relaydeepseek-chat
图片识别vision-relaygpt-5.6-sol
图片生成与编辑images-relaygpt-image-2

配置步骤:

  1. 在“设置 → 模型”分别创建识图 Provider 和 Images API Provider。
  2. 在“模型图片能力”中测试并启用识图模型的 image 能力。
  3. 在上方“基础设置”中选择识图模型。
  4. 在“图片生成与编辑”选择 Images API Provider。
  5. 点击“测试生图 API”。测试固定使用 low1024×1024、PNG,会产生一次实际生图费用。
  6. 看到测试图预览后点击“保存路由”。

生图测试只在内存中预览并校验结果,不会把测试图片永久写入 attachment 存储。

启用后 Agent 可以调用:

  • vision_mix_image_generate:根据提示词生成新图片。
  • vision_mix_image_edit:使用当前会话 attachment 编辑用户图片或上一张生成图。

生成结果会作为 DSH attachment 直接显示在对话中。后续可以继续要求“把刚才生成的图改成夜景”。

没有安装 dsh-better-sidebar 能否使用

可以。缺少的只有“识图记录”和“生图记录”入口,核心路由和对话图片显示不受影响。