DSH Plugins
返回列表
🤖

dsh-resume-turn

模型推理 更新于 2026.09.10

在终端中运行以下命令:

dsh plugin install Harris-Logic/dsh-resume-turn

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install Harris-Logic/dsh-resume-turn 即可安装,插件源码位于 https://github.com/Harris-Logic/dsh-resume-turn

插件介绍

当你使用的模型端点偏慢或连接不稳时,流式回复往往在生成到一半时遭遇超时、断连或限流。默认的 dsh-llm-retry 会把这次请求当作一次全新调用重新发起,前面已经流出的可见文本和整段推理链全部作废,几分钟的生成可能要重复好几轮才能完成——对用户体验和 token 消耗都是不小的代价。

dsh-resume-turn 改变了这一行为:在失败发生的瞬间,它从会话事件日志中提取已经成功流出的部分(包括可见文本和推理块),构造一条引用了该部分内容的引导消息,明确指示模型从上一次的停止位置继续作答,随后以下游恢复的身份接管重试链路。下一次请求因此从中断点起步,而非从零重来。每轮最多自动续写三次,超出后回退给默认重试策略;退避间隔从两秒起指数递增,上限三十秒,行为可通过 resumeCodes、maxPartialChars 等可选键微调。

适合依赖慢速或高抖动端点(例如 AMD DeepSeek 推理接口)做长对话、长思维链生成的用户。端点偶尔断连是常态,而这个插件让断连不再等于推倒重来。

使用场景

  • 长思维链生成中途遭遇超时或断连,已输出的内容无需丢弃
  • 慢速推理端点频繁出现 TRANSPORT、SERVER 或 RATE_LIMIT 错误
  • 流式回复已输出一半时遭遇限流,希望从上次的停止位置继续

适合人员

  • 依赖慢速或高抖动推理端点(如 AMD DeepSeek)的开发者
  • 需要长对话或长推理链流式生成的应用团队
  • 希望减少因断连导致的重复生成与 token 浪费的用户