DSH Plugins
返回列表
🤖

dsh-verdict-guard

模型推理 更新于 2026.08.20

在终端中运行以下命令:

dsh plugin install sagetta1/dsh-verdict-guard

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行安装命令即可启用本插件,源码位于 https://github.com/sagetta1/dsh-verdict-guard,安装后插件以独立 bundle 层进入你的 profile,无需额外配置。

插件介绍

Agent 运行中最贵的那类错误,往往不是一段写错的代码,而是一句轻描淡写的关闭判定:“不工作”、“没有 bug”、“无法复现”。一句虚假的“它没问题”会在下次运行中留下痕迹,而一句虚假的“它有问题”却悄无声息地封死了一条探索方向。这两类错误的代价并不对称,它们也不该适用同一套证明标准。

dsh-verdict-guard 在模型回合的停止边界介入,只检查一件事:模型即将关闭的那段话里,是否附带了读者可以跟进的证据。证据来源分三层——答案文本中的命令输出、文件路径、测试统计;以及该回合会话日志中真实执行过的验证类工具结果(bash、grep、read、test 等)。第三层是关键:纯文本检查只能看到模型写了什么,会话日志则记录了实际跑了什么。若模型贴出一段看似完整的命令转录,但该回合并未调用任何工具,guard 会以更明确的提示将其拦下。

它不判断结论真伪,不做验收,不充当 oracle,只确保一句话出门时旁边放着可以核验的东西。每个回合默认只拦截一次,是减速带而非门禁。适合日常驱动 agent 处理生产系统、担心一句自信的空口判定浪费半天排查时间的工程师使用。

使用场景

  • Agent 回合关闭时结论缺少工具执行证据
  • 模型贴出命令转录但实际未调用任何工具
  • 需拦截无据判定以避免错误方向被静默封存

适合人员

  • 驱动 agent 处理生产系统的工程师
  • 担心 agent 空口判定浪费排查时间的团队
  • 基于 DeepSeek Harness 构建 agent 流水线的开发者