DSH Plugins
返回列表
🤖

llm-as-a-Verifier-dsh

模型推理 更新于 2026.08.26

在终端中运行以下命令:

dsh plugin install aispin-dev/llm-as-a-Verifier-dsh

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中,运行命令 dsh plugin install aispin-dev/llm-as-a-Verifier-dsh 安装此插件,完整源码地址为 https://github.com/aispin-dev/llm-as-a-Verifier-dsh。

插件介绍

llm-as-a-Verifier-dsh 插件旨在解决大型语言模型在推理中面临的难题:尽管像 DeepSeek V4 Flash 这样的模型能生成高质量答案,但自身难以识别最优输出。通过实现 Best-of-N 自验证机制,该插件允许模型在测试时扩展能力,以较低成本达到前沿模型性能,如在 Terminal-Bench 2.1 上以约 1/11 的成本匹配 Fable 5 级评分。

插件的核心能力体现在三个维度:工具面支持按需调用,服务面提供编程接口,模式面则以无感方式将每个对话回合自动转化为 Best-of-N 采样。技术实现上,它采用细粒度奖励评分、概率枢轴锦标赛和前缀缓存布局,确保高效验证;即使在采样超时或资源紧张时,也能通过降级链保持稳健,不会中断对话。

适合 AI 开发者、研究人员以及任何需要高质量模型推理但预算有限的用户。无论是用于学术实验、原型开发还是生产部署,该插件都能显著提升 DeepSeek V4 Flash 的实用性,让普通用户也能以低成本享受到前沿级的推理体验,同时为编排流程和插件集成提供灵活选项。

使用场景

  • 提升语言模型推理准确率
  • 在对话中自动选择最佳回答
  • 进行低开销的模型性能实验

适合人员

  • AI 应用开发者
  • 模型研究科学家
  • 使用 DeepSeek 的工程师