DSH Plugins
返回列表
🤖

dsh-model-router

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install thedeveloper256/dsh-model-router

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中运行 dsh plugin install thedeveloper256/dsh-model-router 即可安装,完整源码见 https://github.com/thedeveloper256/dsh-model-router。

插件介绍

在 DeepSeek Harness 的多代理会话中,每一次模型调用都默认走同一档模型——哪怕子代理只是在跑一行命令或修一个编译报错,也要按 pro 的单价计费。dsh-model-router 要解决的就是这种结构性浪费:它把会话拆成两个角色,根代理(planner)始终跑 deepseek-v4-pro 负责理解需求、设计方案和审阅结果,所有委派出去的子代理(executor)则一律落到 deepseek-v4-flash 负责写代码、跑命令和反复调试。路由改写位于请求管线最外层,优先级高于 Harness 自身默认模型和 UI 手动选择,确保每个角色都跑在正确的档位上。

除了基础的路由改写,插件还注入了三段辅助:一段在代理人格前渲染的提示,告诉 planner 你是思考者、把实现委派出去;一个可在技能目录中按需加载的 pro-flash-routing 技能,明确规划、委派、审阅、汇报的工作节奏;以及可选的视觉路由和错误驱动升级——前者让携带图片的请求自动切到 vision 模型,后者在子代理连续失败后临时提升推理力度,恢复后自动回退。

适合谁用?如果你在 Harness 里跑多代理工作流、子代理大量执行工具调用,又不想为每一次 flash 级别的执行都付 pro 的价格,这个插件就是为你准备的。配置极简:装好即生效,GUI 里一个开关就能整体启停,也支持按角色微调 reasoningEffort 和 maxTokens 来进一步压缩 token 开销。

使用场景

  • 多代理会话中子代理大量执行工具调用,需要降低 pro 模型开销
  • 规划用强模型、执行用快模型的分层工作流
  • 子代理连续失败后临时提升推理力度再自动回退

适合人员

  • 在 DeepSeek Harness 中运行多代理工作流的开发者
  • 对 token 成本敏感、希望按角色分配模型档位的用户
  • 采用子代理委派模式、希望降低执行环节开销的团队