dsh-remote-gpu-monitoring
在终端中运行以下命令:
dsh plugin install sshhhll002/dsh-remote-gpu-monitoring
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install sshhhll002/dsh-remote-gpu-monitoring 完成安装,重启 DeepSeek Harness 后侧边栏即出现 GPU 面板,源码见 https://github.com/sshhhll002/dsh-remote-gpu-monitoring
插件介绍
管理多台 GPU 服务器时,最繁琐的环节莫过于逐台登录、反复执行 nvidia-smi、在多个终端窗口间来回切换。dsh-remote-gpu-monitoring 将整个流程压缩为 DeepSeek Harness 侧边栏中一块实时面板:启动时自动解析 ~/.ssh/config 中的所有具体别名,对每台主机执行一条固定的只读查询,按卡逐张展示型号、显存、利用率、温度与功耗,并用阈值颜色做直观标注。
面板支持按服务器勾选或取消,未选中的主机立即停止轮询;所有浏览器会话共享同一份 Host 端缓存,配合 ControlMaster 连接复用与指数退避策略,刷新代价极低。模型侧提供 gpu_overview(零 SSH 成本的缓存快照)和 gpu_refresh(即时采集)两个工具,让自然语言提问"哪台机器有闲卡"只需一次调用即可得到答案。
适合日常运维多台 GPU 节点的开发者、研究团队,以及希望在对话界面中随时掌握集群状态的任何人——无需额外服务、无需配置文件,安装即用。
使用场景
- 一屏纵览所有 GPU 服务器的显存、利用率与温度
- 用自然语言问哪台机器有闲卡,一次调用即得答案
- 新服务器写入 SSH config 后自动纳入监控面板
适合人员
- 日常运维多台 GPU 节点的开发者
- 需要实时掌握集群状态的研究团队
- 希望在对话界面中管理远程基础设施的工程师