dsh-plugin-judge
在终端中运行以下命令:
dsh plugin install pengxuding/dsh-plugin-judge
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 执行 dsh plugin install pengxuding/dsh-plugin-judge 安装该插件,源码地址:https://github.com/pengxuding/dsh-plugin-judge
插件介绍
在 DeepSeek Harness 插件生态中约束型插件存在一个被普遍忽略的隐性成本:它们让模型忠实地遵守规则,却同时挤压了任务推理真正需要的上下文空间,给一个有能力的模型从下方压低了天花板。更棘手的是,随着模型不断升级,当初为旧模型编写的补丁规则会逐渐从补丁变成天花板,一个曾经有益的插件悄然变得有害。dsh-plugin-judge 正是为此而生——它把插件的价值视为"插件 × 当前模型"的二元关系,而非插件自身的固有属性。
它提供三个使用阶段的闭环。安装前,通过 /plugin-audit 命令、judge_plugin 工具或设置页输入框获取目标插件源码,执行静态扫描与 LLM 判断,输出"是否值得安装"的结论。安装后,枚举当前 profile 中所有已安装插件,将每个分类为能力型、约束型、装饰型或混合型,计算 0–100 的约束风险分,并在设置页的 Plugin Judge 面板中呈现完整报告。当默认模型发生变更时,自动检测切换,标记此前结论依赖旧模型的插件,弹出浮层提醒重新审计。
判断引擎分为两层。第一层是确定性的规则启发式:扫描插件源码中的信号(如 tools.register、systemPrompt.section、complete: true 整体替换、强指令密度等),加权生成约束风险分并归类。第二层按需调用 LLM,将扫描结果、注入内容摘要及当前模型身份交给模型,问一个精准的问题:这些规则对当前这个模型是助力还是压制?——返回带理由的判定。两层结合,既快速可解释,又具备模型感知能力。
适合管理大量插件的 Harness 管理员,尤其是约束型插件占比较高或频繁切换模型的团队。它不替代安全审计,也不阻止任何安装;它只是在三个关键时刻——安装前、安装后、模型切换时——多问一句:这个插件对今天的你,还值不值得留着?
使用场景
- 安装新插件前快速评估其对当前模型是助力还是压制
- 插件库膨胀后批量审计已安装插件的约束风险并分类
- 切换模型版本后检查旧模型时代的插件是否已变为天花板
适合人员
- 管理多个 DeepSeek Harness 插件、需要把控上下文预算的运维人员
- 频繁切换模型版本、需要持续评估插件适配性的开发者
- 对 system prompt 注入和规则堆积敏感的团队管理员