morlay/dsh-plugin--packages-llm-llm-openai-compatible ↗★ 9

@morlay/dsh-llm-openai-compatible

提供带默认采样参数的OpenAI兼容适配器 允许为不同的模型服务商配置默认的温度、惩罚项和种子,适合需要统一管理多模型参数的用户。

套件
@morlay/dsh-llm-openai-compatible
相容性
待驗證
Harness 依賴範圍
workspace:*
Cordis 依賴範圍
workspace:*
版本
0.0.9-alpha.4
授權
MIT
最近更新
2026年9月20日

安裝

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:morlay/dsh-plugin#17db2e513964877a60c0d965cb6696c6539337f8&path:packages/llm/llm-openai-compatible

配置

providers 是 dict:key 就是 provider 路由键(选择器与 GenerateOptions.provider 使用),值是 profile。

llm-openai-compatible:
  providers:
    ollama:
      apiKeyEnv: OLLAMA_API_KEY
      baseURL: https://ollama.com/v1
      displayName: Ollama Gateway
      # === 采样默认参数(请求级 temperature 优先)===
      temperature: 1 # 0..2
      topP: 0.95 # 0..1 → wire top_p
      topK: 40 # 正整数 → wire top_k(非标准,仅网关支持时发送)
      presencePenalty: 0 # -2..2 → wire presence_penalty
      frequencyPenalty: 0 # -2..2 → wire frequency_penalty
      seed: 42 # 正整数 → wire seed
      # === 推理 ===
      reasoning: high # 部署默认档位(省略 = 提供方默认)
      # === 模型目录 ===
      defaultContextWindow: 262144
      defaultMaxTokens: 32768
      models:
        - id: deepseek-v4-flash:0731
          name: DeepSeek V4 Flash
          contextWindow: 1000000
          maxTokens: 65535
          inputModalities: [text, image]
          reasoningEfforts:
            off: # off 空值 = 不发送 reasoning_effort
            high: high # 档位 → wire reasoning_effort 拼写
            max: max
      # === 传输 ===
      maxRequestImageBytes: 20971520
      streamIdleTimeoutMs: 300000
      timeoutMs: 600000 # 整体请求超时;缺省不设
      retryPolicy:
        mode: normal
        maxRetries: 5