dsh-openai-server-compaction
在终端中运行以下命令:
dsh plugin install ylxmf2005/dsh-openai-server-compaction
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在 DeepSeek Harness 中执行 dsh plugin install ylxmf2005/dsh-openai-server-compaction 即可安装,完整源码地址为 https://github.com/ylxmf2005/dsh-openai-server-compaction
插件介绍
在 OpenAI Responses 路由上,长对话很快就会触碰上下文上限,而客户端简单截断又会让早期关键信息彻底丢失。dsh-openai-server-compaction 将 Codex Remote Compaction V2 引入 DSH,让服务器端完成压缩,客户端只保留最近真实用户消息加一个不透明压缩项——既省 token 又不丢语义。
插件支持手动、token 压力及溢出三种触发模式,单次最多保留 64,000 token 的近期消息。不透明压缩状态以加密文件持久化到会话 JSONL 之外,DSH 重启后可自动恢复;同时向标准 DSH 历史写入一份 4,096 token 上限的可移植文本检查点,确保会话仍可切换到其他供应商继续。缺少凭据、配置歧义、非法规程流等异常一律显式失败,绝不静默回退到 Chat Completions。
适合在 DSH 中运行 openai-responses 路由、需要精细长上下文管理的开发者。从旧版 llm-openai-server-compaction 迁移的用户也能获得清晰的指引:插件在检测到未清除的旧命名空间时会拒绝启动,避免两套配置互相干扰。
使用场景
- 长对话接近上下文上限时由服务器自动压缩历史
- 手动或 token 压力触发压缩以释放 token 预算
- 跨供应商迁移会话时保留可移植文本摘要
适合人员
- 在 DSH 中运行 openai-responses 路由的开发者
- 需要精细控制长上下文与 token 开销的团队
- 从旧版 llm-openai-server-compaction 迁移的用户