dsh-poor-router
在终端中运行以下命令:
dsh plugin install yishengdaxiaonengjihui/dsh-poor-router
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中运行 dsh plugin install yishengdaxiaonengjihui/dsh-poor-router 即可安装本插件,完整源码地址为 https://github.com/yishengdaxiaonengjihui/dsh-poor-router
插件介绍
免费大模型额度分散在 NVIDIA 赠品、Qwen 赠予、GLM 闪速、OpenRouter :free 等各处,各自在不同时段失效。你正写到一半模型就断了,赶紧切到下一家,下一家也只剩一口气。dsh-poor-router 把这些零散的免费与廉价额度当作一个池子来管理:逐请求计量、实时采样健康度、故障毫秒级切换,让你的会话对切换毫无感知。
路由决策基于 Thompson 采样:每条模型记录维护 Beta 后验(成功/失败计数),采样时叠加 TTFT 延迟惩罚与当前小时拥塞桶权重,而非凭直觉猜。辅助与子请求优先路由到剩余配额最厚的执行器模型,每第六次请求触发一次探索未用层级。仅当所有免费候选全部阵亡时,逃生舱才释放最便宜的限额付费模型,并发送短信告知你花了钱。提供商层面,AUTH 或 QUOTA 级失败触发 10 分钟冷却,429 响应冷却 90 秒,冷却状态跨重启持久化。
该插件以无状态方式工作:每个请求从你配置的模型出发,本次允许临时替换,绝不永久改写配置。它同样支持无图形界面运行,两个 agent 工具在 headless 环境下完全可用。适合靠碎片化免费与预算额度生存的独立开发者和小团队;如果你养得起 API 账单,大可不必。
截图预览
使用场景
- 同时接入 NVIDIA、Qwen、GLM、OpenRouter 等多家免费模型,需要按实时健康度自动择路
- 免费模型频繁超时或断连,希望当前请求无感切换到同层级备用模型
- 将辅助与子请求路由到剩余配额最厚的执行器模型,节省主力配额
适合人员
- 依赖多家免费/廉价 LLM 额度的独立开发者
- 需要严格控制在 API 支出上的小型团队
- 同时管理多个 LLM 提供商、希望统一调度的工程师