dsh-vision-plugin
在终端中运行以下命令:
dsh plugin install zcma11/dsh-vision-plugin
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端运行 dsh plugin install zcma11/dsh-vision-plugin,或从源码地址 https://github.com/zcma11/dsh-vision-plugin 克隆后按提示安装依赖。
插件介绍
在 DeepSeek Harness 对话中,主模型只能看到纯文本。一张报错截图、一张手绘流程图、一张产品 UI 稿,粘贴进去就是一片空白。dsh-vision-plugin 弥补了这个断层:在聊天输入框中上传图片或 Ctrl+V 粘贴,发送时插件自动将图片转述为文字描述并以固定前缀注入消息,让主模型真正读到图片内容。
插件提供两条严格路由的转述通道:视觉按钮或粘贴触发百炼 DashScope 视觉模型(需配置 API Key 并选择支持图片输入的模型),OCR 按钮则走 Windows 10+ 内置离线 OCR,完全无需网络。两者互不降级,失败时精准定位是模型调用还是识别环节出了问题,消息不会误发给主模型,预览条保留数据可直接重试。
适合在 Windows 环境下频繁向 AI 分享截图、报错日志、图表或设计稿的开发者与知识工作者使用。图片仅存内存不落盘,转述完成即清除,兼顾便利与隐私。
截图预览
使用场景
- 把报错截图粘贴到对话框,让主模型直接读图排查问题
- 贴一张手绘流程图,让 AI 理解逻辑后给出实现建议
- 分享一张 UI 设计稿,让 AI 基于视觉内容优化代码
适合人员
- 频繁向 AI 分享截图或图表的开发者
- 需要离线处理图片内容、不便配置 API Key 的用户
- 在 Windows 环境下使用 DeepSeek Harness 的知识工作者