DSH Plugins
返回列表
🤖

dsh-shift-router

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install green-dalii/dsh-shift-router

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install green-dalii/dsh-shift-router 即可安装该插件,源码位于 https://github.com/green-dalii/dsh-shift-router 。

插件介绍

日常轮次不该花旗舰预算,关键轮次也不该交给便宜模型草率处理。dsh-shift-router 在每轮顶层 Agent 起步前调用轻量 LLM Judge 将消息判定为 fast 或 smart,随后整轮推理——思考、工具调用、代码编辑——均由对应层级模型承接。升级即刻切换,降级则需滑动窗口多数确认,避免频繁抖动。

插件内置完整的运行弹性:429、5xx 或配额错误触发指数退避冷却(1 min 至 6 h 封顶),在同一层级内自动切换下一健康模型,不跨层、不丢上下文。复杂任务由 Smart 模型以 CTO 模式规划并委派 Fast 子代理实现,每轮委派与失败均计入插件强制的硬上限,超限后工具直接拒绝,杜绝无限循环。成本遥测可按层级追踪 token 与吞吐量,支持可选 USD 定价表量化会话开销。

面向在 DeepSeek Harness 上做多模型推理、希望兼顾质量与成本的开发者与团队。零配置即启动,所有参数经 GUI 卡片或 /router config 命令实时生效、无需重启,一套补丁即可接入任意 profile。

使用场景

  • 日常对话走便宜模型,复杂推理自动升级到旗舰层级
  • 模型服务报 429 或 5xx 时指数退避冷却并切换到同层备用模型
  • 复杂任务由 Smart 模型规划、委派 Fast 子代理实现并审查结果

适合人员

  • 在 DeepSeek Harness 上运行多模型推理的开发者
  • 希望按任务难度动态切换模型以控制 token 成本的团队
  • 需要为模型链路设计容错与降级策略的平台工程师