DSH Plugins
返回列表
🤖

dsh-model-router

模型推理 更新于 2026.09.15

在终端中运行以下命令:

dsh plugin install Neptune810/dsh-model-router

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中运行 dsh plugin install Neptune810/dsh-model-router,插件源码位于 https://github.com/Neptune810/dsh-model-router,安装完成后重启 dsh web 即可生效。

插件介绍

用 DeepSeek flash 做日常开发时,一个容易忽视的矛盾是:翻译一行注释和审查一段工程 diff 不该消耗同一种推理力度,但默认配置往往一视同仁。dsh-model-router 正是为此而生——它不切换模型,只决定每一步该想多深,让 trivial 请求零思考直接出结果,让 dense 工程 brief 拉满推理预算,中间档则落在输出曲线仍然陡峭的 sweet spot 上,避免多花 1.6 到 1.8 倍 token 换边际收益。

核心机制是一张四档路由表(trivial / standard / engineering / hard),由步骤里的工程线索、代码或 diff 结构、agent 工具循环等信号自动判定。它刻意不设置棘轮:轮次深度默认不计分,长 session 不会自动漂向最贵档位;升级必须有证据,即工具反复失败或同参数重试达到阈值才允许上移,且最多连续升两档;max 档位默认不可达,必须显式开启 allowMax 才生效,手写路由表要求 max 也会被钳回 high。

插件为 host-only 设计,没有浏览器 UI,不产生客户端 bundle,注册完监听器后完全静默运行。它只接管 deepseek-official 下匹配 familyPattern 的模型,其他模型和图像步骤默认原样放行。适合频繁用 DeepSeek flash 跑 agent 工作流、希望按步骤复杂度精细控制 token 开销和响应延迟的开发者;如果你已经在用 dsh web 并且 profile 里混着 flash 与 pro 两种会话,它也能把 pro 会话自动拉回 flash,保持推理策略一致。

使用场景

  • 在agent工作流中让简单步骤快出结果、复杂步骤深度思考
  • 混合flash与pro会话时统一推理策略
  • 按任务复杂度控制token开销与响应延迟

适合人员

  • 频繁用DeepSeek flash跑agent工作流的开发者
  • 关注token成本与响应延迟的独立开发者
  • 需要按步骤精细控制推理力度的dsh web用户