DSH Plugins
返回列表
🤖

dsh-llm-verifier

模型推理 更新于 2026.08.25

在终端中运行以下命令:

dsh plugin install Aa728848/dsh-llm-verifier

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,使用命令 'dsh plugin install Aa728848/dsh-llm-verifier' 安装插件,完整源码地址为 https://github.com/Aa728848/dsh-llm-verifier。

插件介绍

在 DeepSeek Harness 中,主 Agent 专注于执行具体任务,如编写代码或运行命令,但往往缺乏独立的验证机制来确保任务质量和可靠性。dsh-llm-verifier 填补了这一空白,它引入了一个“选手+裁判”模式:主 Agent 作为选手执行工作,而 Verifier 作为裁判,收集任务目标、候选方案和真实执行结果,并交由你指定的独立模型进行仲裁。这有助于评估哪个方案更可靠、任务的实际进度以及是否存在隐藏错误,从而提升自动化工作流的严谨性。

该插件的核心能力包括四个显式工具:成对比较、锦标赛选择、进度跟踪和会话复核,覆盖从候选方案筛选到任务验收的全流程。它支持智能或严格的自动路由策略,在 Agent 会话的生命周期边界自动调度这些工具,并结合 A–T 细粒度标尺和概率评分机制进行精准评估。此外,通过概率基准锦标赛算法,它能高效处理多候选方案,显著减少 API 调用成本。所有配置均可在 DSH 设置中可视化调整,包括模型选择、推理强度和缓存策略,同时确保会话数据脱敏,保护隐私。

dsh-llm-verifier 特别适合使用 DeepSeek Harness 进行复杂任务开发的团队和个人,如代码生成、多步骤工作流或长期项目监控。无论你是需要自动化质量验证、比较不同解决方案,还是实时跟踪任务进展,它都能提供可靠的裁判支持,帮助减少人工复核负担,提升开发效率和交付质量。

使用场景

  • 比较多个候选代码方案的优劣。
  • 跟踪长任务中各检查点的完成进度。
  • 自动复核当前会话的输出质量。

适合人员

  • 使用 DeepSeek Harness 进行代码生成的开发者。
  • 需要自动化验证工作流的团队。
  • 负责长任务编排和监控的项目管理者。