dsh-llm-error-retry
在终端中运行以下命令:
dsh plugin install liaoyuqing/dsh-llm-error-retry
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 终端中执行 dsh plugin install liaoyuqing/dsh-llm-error-retry(源码地址:https://github.com/liaoyuqing/dsh-llm-error-retry),安装后重启对应 profile 即可在 GUI 设置页看到 LLM 错误重试配置分区。
插件介绍
调用大模型时,429 限流、503 过载几乎是每个 DSH 用户的日常。内置的快速指数退避应对短时抖动已经够用,但面对配额耗尽、百炼 / DashScope 把状态码压平进 message 文本这类场景,既无法精确命中,也缺少休眠时长与重试次数的细粒度控制。dsh-llm-error-retry 正是为补齐这一缺口而生。
插件监听 agent/request-error 事件链,支持按 HTTP 状态码、机器码(如 RATE_LIMIT、QUOTA)、响应字段 = 值三种形态命中报错。每条规则独立配置休眠时长(100 ms 至 1 h)与最大重试次数,预算耗尽后错误如实上报、不会无限吞错。重试过程在会话框内以原生卡片即时渲染,规则在 GUI 设置页实时编辑、保存即生效、跨重启持久,无需重启 profile。
如果你用 DSH 搭建大模型工作流、经常踩到限流或需要针对特定供应商错误码做差异化重试,又不想自己写 waterfall 监听和会话事件拼装,这个插件就是即插即用的答案。零运行时依赖、无构建脚本,装上即用。
使用场景
- 模型请求遭遇 429 限流或 503 过载时,按自定义休眠时长自动重试
- DashScope 或百炼适配器将状态码压平进 message 文本时,通过字段规则精确命中报错
- 在 GUI 设置页实时调整各错误码的休眠时长与最大重试次数,保存即生效、跨重启持久
适合人员
- 频繁遭遇大模型限流、需要差异化重试策略的 DSH 用户
- 搭建多供应商 LLM 工作流、需要按供应商错误码做细粒度重试的工程师
- 不想手写 waterfall 监听与会话事件拼装、追求即插即用的团队