visual-review
在终端中运行以下命令:
dsh plugin install wang-bool/visual-review
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中安装 visual-review 插件,请使用命令 dsh plugin install wang-bool/visual-review,或从完整源码地址 https://github.com/wang-bool/visual-review 手动安装。
插件介绍
在 AI 对话中,图片是直观的信息载体,但传统文本模型无法直接感知图像内容,导致用户在 DeepSeek Harness(DSH)Web 界面中上传图片时,模型无法有效响应。这一局限影响了多模态交互的体验,尤其在需要图像分析的场景中。visual-review 插件应运而生,它为 DSH Web 界面带来了双面增强:一方面,用户粘贴或上传的图片能直接渲染在聊天气泡中,实现可视化;另一方面,通过智能拦截和注解转换,插件使任何文本模型都能“看见”图片,并调用内置的 visual_review 工具进行视觉解读,返回中文文字描述,覆盖文字、物体、场景等元素。其双引擎设计优先支持云端 OpenAI 兼容 API(零依赖),未配置时自动回退到本地 Qwen3-VL-8B 模型,确保数据隐私。这款插件特别适合 DSH Web 的用户群体,包括 AI 开发者、研究人员以及日常需要处理图像内容的爱好者。它无需更换基础模型,即可无缝集成图像能力,无论是快速分析本地文件还是定制化提问(如提取图表趋势),都能轻松应对。注重数据安全的用户更能受益于本机引擎,所有处理均在本地完成,不出本机。
使用场景
- 用户粘贴图片到聊天,模型自动解读并返回描述
- 让模型分析磁盘上的图片文件,提取文字或内容
- 定制化提问,如描述图表趋势或识别物体场景
适合人员
- AI 开发者需要集成视觉功能到聊天界面
- 研究人员进行图像相关实验和数据分析
- 日常用户处理图片内容,希望模型能直接响应