dsh-agent-arena
在终端中运行以下命令:
dsh plugin install LeemanCheung/dsh-agent-arena
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中,您可以通过运行命令 dsh plugin install LeemanCheung/dsh-agent-arena 或访问 GitHub 仓库 https://github.com/LeemanCheung/dsh-agent-arena 来安装此插件。
插件介绍
在选择AI编码助手时,许多开发者面临一个共同难题:不同模型在宣传中各有所长,但究竟哪个最适合自己的特定任务和代码库?盲目尝试多个模型不仅耗时,也难以进行客观对比。dsh-agent-arena 应运而生,它提供了一个受控的“竞技场”,让您能基于一个真实的编码目标(例如实现一个功能或修复一个bug),公平地让多个模型一决高下。
其核心能力在于提供一个完全隔离、可复现的评估环境。插件会在独立的 Git 工作区中运行每个模型的修改,然后通过您预先定义的、确定性的验证命令(如单元测试、代码检查)来严格评判结果。整个过程透明且可审计,您可以审查每个模型的完整代码差异(diff),最终由系统根据验证结果的权重自动选出“赢家”,并支持您一键应用其修改,整个过程安全可靠。
这个插件特别适合技术领导者、架构师以及注重工程效率的团队。如果您正在为项目评估或选型AI编码工具,dsh-agent-arena 能为您摆脱厂商的营销话术,提供基于您自身代码库和测试标准的实证数据。它也适用于研究社区,用于对模型在真实场景下的代码生成能力进行基准测试和对比分析。
截图预览
使用场景
- 在多个AI模型中选择最佳编码助手
- 评估模型在真实代码库上的修改表现
- 进行标准化的模型性能基准测试
适合人员
- 技术领导者和架构师
- 注重效率的工程团队
- AI模型研究社区