sidesight
在终端中运行以下命令:
dsh plugin install ZhuXinAI/sidesight
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DSH 对话中请 agent 执行安装,或直接运行 dsh plugin install ZhuXinAI/sidesight,源码位于 https://github.com/ZhuXinAI/sidesight 。
插件介绍
SideSight 解决一个常见的痛点:文本-only 编码模型无法直接理解截图、图表、UI 界面或视频。开发者在调试前端、分析数据可视化或对比设计稿时,往往需要「看懂」图像,而模型本身并不具备原生视觉能力。SideSight 为 DeepSeek Harness 提供了一条安全、可编排的视觉桥接路径——它调用独立配置的多模态模型完成图像分析,再把精简的文本证据交还给宿主编码模型,全程无需模型原生支持图像输入。
核心能力涵盖截图解读、技术图表理解、数据可视化分析、UI 差异对比、错误诊断和有限帧视频分析。在 macOS 上,SideSight 还能通过 Apple Vision 引擎完成纯本地 OCR,不向任何云端发送数据。API 密钥采用 write-only 存储,永远不会在日志或输出中回显;媒体文件经过路径白名单、大小与分辨率上限等多层校验,确保不可信输入不会逃逸到工作区之外。
适合正在使用 DeepSeek V4 Flash 等文本-only 模型、同时需要在编码流程中处理视觉材料的开发者,以及希望为 MCP 客户端或 Codex 类 agent 接入轻量视觉能力的团队。
截图预览
使用场景
- 用文本-only 编码模型调试前端渲染问题时,让 SideSight 读取截图并返回结构化错误线索
- 对比两版 UI 设计稿的视觉差异,获取逐区域的结构化 diff 描述
- 在 macOS 上离线提取截图中文字,全程不经过任何云端服务
适合人员
- 运行 DeepSeek V4 Flash 等文本-only 模型、仍需在编码流程中处理图像的开发者
- 希望为 MCP 客户端或 Codex agent 接入轻量视觉层而不想额外部署图片管道的工程师
- 需要在 macOS 上离线完成 OCR、不愿将截图发送到任何云端的隐私敏感用户
