DSH Plugins
返回列表
🤖

dsh-gray-test

模型推理 更新于 2026.09.02

在终端中运行以下命令:

dsh plugin install LiLiLi-Zi/dsh-gray-test

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 终端中执行 dsh plugin install LiLiLi-Zi/dsh-gray-test(源码地址 https://github.com/LiLiLi-Zi/dsh-gray-test),安装完成后重启 dsh 即可在设置页找到灰度测试入口。

插件介绍

用 DeepSeek 官方路由写代码时,你很难凭感觉判断当前拿到的到底是正式模型还是灰度内测版。dsh-gray-test 就是为这个问题设计的:它在你本地 dsh 里批量开出一组并发会话,逐条流式读取思维链,用一句话风格差异——I'm 加动词 ing 的密度相对 Let me 的比例——把每个会话实时归入灰度、正常或异常三类,最终给你一张灰度出现率统计表。

判定逻辑刻意做了分级:正常模型的 Let me 模板化复述一旦达到阈值,会话立刻掐断以节省额度;被标为灰度模型的会话则完整跑完,方便你回看 ~/gray-test-runs/ 下各会话的完整产出做二次确认;既无英文模板也无灰度风格的(比如纯中文思维链)归为异常,同样完整保留。此外你还可以挑选 dsh 内置的 standard、code、minimal、cordis 四种 Agent 预设或自定义预设,让测试更贴近实际工作负载。

如果你日常用 dsh 跑 deepseek-v4-pro 或 deepseek-v4-flash,又不确定自己账号当前命中的是哪一档模型,这个插件能让你一次并发几十路会话、几分钟内拿到灰度比例,比逐条手测高效得多。

使用场景

  • 批量并发会话判断当前 DeepSeek 官方路由是否命中灰度模型
  • 流式监听思维链实时区分灰度、正常与异常三种模型风格
  • 统计灰度出现率并保留各会话完整产出用于二次确认

适合人员

  • 日常用 dsh 调用 deepseek-v4-pro 或 deepseek-v4-flash 的开发者
  • 需要确认账号当前命中正式模型还是内测灰度版的用户
  • 希望批量验证模型行为一致性、省去逐条手测的工程师