JessenReinhart/dsh-tokenslash ↗★ 0

dsh-tokenslash

TypeSafe Jev token optimization suite for DeepSeek Harness (DSH): Subagent Router, Fork Decoupler, Tool Schema Pruner, Output Compactor, and Settings UI 适合需要子代理路由、工具裁剪等深度Token优化和控制的用户。

Package
dsh-tokenslash
Compatibility
Unverified
Version
1.0.0
Last updated
Sep 28, 2026

Install

$npx -p @deepseek-ai/dsh dsh plugin --profile web add github:JessenReinhart/dsh-tokenslash

Configuration

KeyTypeDefaultPurpose
enabledbooleantrueMaster switch
providerstringopencodeActive Jev provider id
customBaseUrlstringhttp://127.0.0.1:20128/v1/systemoneBase URL when provider=custom
apiKeystring""Bearer token for auth providers
modelstringjev-1.13-freeDefault triage model
decoupleThresholdnumber (0-1)0.85Confidence cutoff for subagent fork
modelTiers.cheapstring (CSV)gemini-2.5-flash, deepseek-chat, gpt-4o-miniCheap tier list
modelTiers.mediumstring (CSV)gemini-2.5-pro, claude-3-5-haikuMedium tier list
modelTiers.smartstring (CSV)deepseek-reasoner, claude-3-7-sonnet, gpt-4oSmart tier list
toolPruningModestring"normal"Pruning mode: "normal" (intent-based, keep core tools), "extreme" (prune all tools), "off" (no tool pruning)
pinnedToolsarray of strings[]Explicit tool names to preserve regardless of intent or extreme pruning
failOpenbooleantruePreserve all tool groups if triage endpoint fails or returns invalid response
modules.subagentRoutingbooleantrueEnable routing hook + auto-route handler
modules.toolPruningbooleantrueEnable tool output prune hook
modules.promptPruningbooleantrueEnable system prompt & tool schema pruning before model request
modules.outputCompactingbooleantrueEnable compact hook
modules.goalGuardbooleantrueEnable goal budget warnings

Helpers:

  • parseConfig(raw) — schema-validated config with defaults.
  • parseModelTiers(tiers) — CSV/array → { cheap, medium, smart } arrays.
  • getConfigForProvider(provider, overrides) — resolves baseUrl/model per provider.
  • getProviderConfig(provider, config) / listProviders() / fetchModels(provider, opts) — cached (5 min TTL) model discovery; clearModelsCache() busts cache.