DSH Plugins
返回列表
🤖

dsh-openai-server-compaction

模型推理 更新于 2026.08.22

在终端中运行以下命令:

dsh plugin install ylxmf2005/dsh-openai-server-compaction

将以下提示词粘贴到 DeepSeek Harness 对话框中:

在 DeepSeek Harness 中执行 dsh plugin install ylxmf2005/dsh-openai-server-compaction 即可安装,完整源码地址为 https://github.com/ylxmf2005/dsh-openai-server-compaction

插件介绍

在 OpenAI Responses 路由上,长对话很快就会触碰上下文上限,而客户端简单截断又会让早期关键信息彻底丢失。dsh-openai-server-compaction 将 Codex Remote Compaction V2 引入 DSH,让服务器端完成压缩,客户端只保留最近真实用户消息加一个不透明压缩项——既省 token 又不丢语义。

插件支持手动、token 压力及溢出三种触发模式,单次最多保留 64,000 token 的近期消息。不透明压缩状态以加密文件持久化到会话 JSONL 之外,DSH 重启后可自动恢复;同时向标准 DSH 历史写入一份 4,096 token 上限的可移植文本检查点,确保会话仍可切换到其他供应商继续。缺少凭据、配置歧义、非法规程流等异常一律显式失败,绝不静默回退到 Chat Completions。

适合在 DSH 中运行 openai-responses 路由、需要精细长上下文管理的开发者。从旧版 llm-openai-server-compaction 迁移的用户也能获得清晰的指引:插件在检测到未清除的旧命名空间时会拒绝启动,避免两套配置互相干扰。

使用场景

  • 长对话接近上下文上限时由服务器自动压缩历史
  • 手动或 token 压力触发压缩以释放 token 预算
  • 跨供应商迁移会话时保留可移植文本摘要

适合人员

  • 在 DSH 中运行 openai-responses 路由的开发者
  • 需要精细控制长上下文与 token 开销的团队
  • 从旧版 llm-openai-server-compaction 迁移的用户