dsh-vision
在终端中运行以下命令:
dsh plugin install linenxi-ctrl/dsh-vision
将以下提示词粘贴到 DeepSeek Harness 对话框中:
请在 DeepSeek Harness 终端中运行 `dsh plugin install linenxi-ctrl/dsh-vision` 进行安装,更多离线或手动安装方式请访问 https://github.com/linenxi-ctrl/dsh-vision 查看详细指南。
插件介绍
在使用 DeepSeek Harness 时,许多强大的纯文本模型往往因为缺乏原生视觉能力而无法处理图像或屏幕信息。dsh-vision 插件正是为了解决这一痛点而生,它通过引入「外挂识图模型」机制,让原本只能处理文本的 AI 瞬间拥有了“眼睛”。无论是分析复杂的报错截图,还是理解用户随手上传的照片,它都能轻松胜任。
该插件的核心能力在于其高度的自动化与灵活性。用户不仅可以通过界面右下角的快捷按钮快速配置各类主流视觉 API(如 OpenAI、Anthropic、Gemini 等),还能让图片识别结果无缝回传至当前会话。更强大的是,它为 Agent 注入了自主截屏与识图工具,模型可以根据上下文自行决定何时截取屏幕并进行视觉分析,实现真正的跨模态交互。
如果你是一位深度依赖 DeepSeek Harness 的开发者或效率极客,且经常需要 AI 协助排查前端 UI 问题、分析图表或处理多模态任务,那么 dsh-vision 将是你的必备利器。它完美填补了纯文本模型在视觉领域的空白,让你的智能助手变得更加全能。
使用场景
- 让纯文本模型自动截取屏幕并分析报错信息。
- 上传图片并调用外部视觉API提取文字与描述内容。
- 为Agent添加视觉工具以实现跨模态的自动化任务。
适合人员
- 需要让纯文本大模型具备图像处理能力的开发者。
- 经常使用AI助手排查前端UI或代码报错的程序员。
- 希望为DeepSeek Harness扩展多模态交互的效率极客。