DSH Plugins
返回列表
dsh-poor-router

dsh-poor-router

工作流 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install yishengdaxiaonengjihui/dsh-poor-router

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中运行 dsh plugin install yishengdaxiaonengjihui/dsh-poor-router 即可安装本插件,完整源码地址为 https://github.com/yishengdaxiaonengjihui/dsh-poor-router

插件介绍

免费大模型额度分散在 NVIDIA 赠品、Qwen 赠予、GLM 闪速、OpenRouter :free 等各处,各自在不同时段失效。你正写到一半模型就断了,赶紧切到下一家,下一家也只剩一口气。dsh-poor-router 把这些零散的免费与廉价额度当作一个池子来管理:逐请求计量、实时采样健康度、故障毫秒级切换,让你的会话对切换毫无感知。

路由决策基于 Thompson 采样:每条模型记录维护 Beta 后验(成功/失败计数),采样时叠加 TTFT 延迟惩罚与当前小时拥塞桶权重,而非凭直觉猜。辅助与子请求优先路由到剩余配额最厚的执行器模型,每第六次请求触发一次探索未用层级。仅当所有免费候选全部阵亡时,逃生舱才释放最便宜的限额付费模型,并发送短信告知你花了钱。提供商层面,AUTH 或 QUOTA 级失败触发 10 分钟冷却,429 响应冷却 90 秒,冷却状态跨重启持久化。

该插件以无状态方式工作:每个请求从你配置的模型出发,本次允许临时替换,绝不永久改写配置。它同样支持无图形界面运行,两个 agent 工具在 headless 环境下完全可用。适合靠碎片化免费与预算额度生存的独立开发者和小团队;如果你养得起 API 账单,大可不必。

截图预览

使用场景

  • 同时接入 NVIDIA、Qwen、GLM、OpenRouter 等多家免费模型,需要按实时健康度自动择路
  • 免费模型频繁超时或断连,希望当前请求无感切换到同层级备用模型
  • 将辅助与子请求路由到剩余配额最厚的执行器模型,节省主力配额

适合人员

  • 依赖多家免费/廉价 LLM 额度的独立开发者
  • 需要严格控制在 API 支出上的小型团队
  • 同时管理多个 LLM 提供商、希望统一调度的工程师