Hermes新增OpenAI服务端压缩,优化长会话上下文管理
转发 @tonysimons_:Hermes 智能体每日小贴士:🪽
如果你在 Hermes 上运行 GPT-5.6,有一个全新设置你应该了解。
Hermes 现在可以使用 OpenAI 的原生 Responses API 进行服务端压缩,用于长时间运行的会话。
开启方法:
compression:
codex_responses_native: true
妙处在于:
Hermes 不必再本地压缩庞大的对话,OpenAI 可以先在服务端压缩较旧的上下文。
Hermes 会保留加密的压缩检查点,并在未来的轮次中重放。
因此你会获得:
→ 更好的长会话上下文管理
→ 跨轮次的持久压缩
→ 减少不必要的转录负担
→ Hermes 正常的本地压缩仍作为后备方案
而且这个功能并不会在所有提供商上盲目启用。
它专门针对通过直接 OpenAI API 或你的 ChatGPT Codex 订阅运行的 GPT-5.6。
OpenRouter、xAI、Copilot、本地模型等,不会强行塞入这个字段然后说“祝你好运”。😂
这个功能昨天上线。
如果你在长时编码或智能体工作流中使用 Hermes 搭配 GPT-5.6,我绝对建议试试。🤘🏻
如果你在 Hermes 上运行 GPT-5.6,有一个全新设置你应该了解。
Hermes 现在可以使用 OpenAI 的原生 Responses API 进行服务端压缩,用于长时间运行的会话。
开启方法:
compression:
codex_responses_native: true
妙处在于:
Hermes 不必再本地压缩庞大的对话,OpenAI 可以先在服务端压缩较旧的上下文。
Hermes 会保留加密的压缩检查点,并在未来的轮次中重放。
因此你会获得:
→ 更好的长会话上下文管理
→ 跨轮次的持久压缩
→ 减少不必要的转录负担
→ Hermes 正常的本地压缩仍作为后备方案
而且这个功能并不会在所有提供商上盲目启用。
它专门针对通过直接 OpenAI API 或你的 ChatGPT Codex 订阅运行的 GPT-5.6。
OpenRouter、xAI、Copilot、本地模型等,不会强行塞入这个字段然后说“祝你好运”。😂
这个功能昨天上线。
如果你在长时编码或智能体工作流中使用 Hermes 搭配 GPT-5.6,我绝对建议试试。🤘🏻