DSH Plugins
返回列表
🤖

dsh-plugin-amdgpu-inspect

模型推理 更新于 2026.08.15

在终端中运行以下命令:

dsh plugin install yujiaoliang/dsh-plugin-amdgpu-inspect

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install yujiaoliang/dsh-plugin-amdgpu-inspect 即可安装本项目,源码详见 https://github.com/yujiaoliang/dsh-plugin-amdgpu-inspect 。

插件介绍

让 DeepSeek Harness 中的智能体真正读懂 AMDGPU 二进制文件,过去往往意味着把一大段 llvm-objdump 输出硬塞进上下文窗口然后祈祷。dsh-plugin-amdgpu-inspect 用两个结构化工具调用替代了这种做法:amdgpu_object_inspect 列出文件中的内核并报告 code-object 元数据与指令类别计数;amdgpu_isa_query 按页遍历单个内核的规范化指令流,每次响应上限 200 条并通过确定性游标翻页,让完整反汇编永远不会淹没模型窗口。插件只报告静态事实——不编译源码、不加载 HSA 运行时、不执行 GPU 代码、不预测性能。

在原始 API 之上,内置的 Kernel X-Ray Skill 为智能体提供了一套结构化工作流:编译前后产物、查询本插件、形成假设、并要求在宣称加速之前必须给出实际负载测量数据。底层实现上,以绝对路径、文件大小和修改时间为键的单产物缓存让重复调用保持廉价;子进程不经过 shell 运行且响应工具调用取消;输入限制为不超过 256 MiB 的常规文件。

适合手中已有 HSACO 或 ELF 文件、想要检查其中包含哪些内核、某个操作码出现在哪里、或两次构建之间指令流发生了何种变化的工程师。插件本身保持低层事实层的定位,策略与结论由 Skill 或你自己的提示词负责,便于嵌入更大的智能体编排流程。

使用场景

  • 查看一个 HSACO 或 ELF 文件包含哪些 kernel 及其 code-object 元数据
  • 逐页查询某个 kernel 的规范化指令流,快速定位特定操作码与操作数
  • 对比两次构建产物的指令流差异,为优化假设提供静态证据

适合人员

  • 已持有 AMDGPU 编译产物、需要检查内核结构但不想执行 GPU 代码的工程师
  • 在 DeepSeek Harness 中编排 GPU 相关智能体工作流的开发者
  • 需要静态 ISA 分析能力且依赖 ROCm LLVM 工具链的研究者