DSH Plugins
返回列表
🤖

dsh-adaptive-model-router

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install icyaaaww/dsh-adaptive-model-router

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install icyaaaww/dsh-adaptive-model-router 即可安装,完整源码地址为 https://github.com/icyaaaww/dsh-adaptive-model-router ,安装后插件会按轮次自动在经济与经济质量模型间路由。

插件介绍

在 DeepSeek Harness 中同时配置了 Flash 与 Pro 两个模型时,人工判断每轮任务复杂度再手动切换路由既繁琐又容易出错。dsh-adaptive-model-router 在本地提供一个同步、确定性、可复现的逐轮自适应路由层:简单任务留在经济模型,复杂任务或连续无进展时自动升级到质量模型。整个过程不额外调用任何分类模型,不注入提示词或隐藏指令,不增加任何 token 或提供方请求。

路由逻辑完全基于规则:进入文本达到可配置的长度阈值、或命中配置的关键词时即选中质量路由;单轮内具有惯性(hysteresis),只升不降;连续工具失败次数超过设定值也会触发升级。成功执行的工具仅重置失败计数,不会将已升级的轮次降回。新一轮对话重新开始判断,可回到经济路由。每条路由支持可选的 reasoningEffort 与 maxTokens,其余请求字段保持不变。插件对 DeepSeek Harness 0.1.1-rc.2 进行适配,以纯 ESM JavaScript 发布,无运行时依赖。

适合在 Harness 中并行运行多个模型的开发者,以及重视推理链可复现性、遥测可见性和按轮次成本优化的团队。通过调整阈值即可平衡质量与开销,无需改动业务代码。

使用场景

  • 简单问答留在 Flash,复杂代码生成自动升级到 Pro 处理
  • 连续工具调用失败超过阈值时自动切换到高质量模型重试
  • 多模型并行环境中按轮次自动平衡 token 开销与输出质量

适合人员

  • 在 DeepSeek Harness 中同时配置多模型并需要自动路由的开发者
  • 重视推理链可复现性与遥测可见性的工程团队
  • 希望按轮次自动平衡 token 成本与输出质量的 AI 应用工程师