动态

Hermes新增OpenAI服务端压缩,优化长会话上下文管理

Hermes新增OpenAI服务端压缩,优化长会话上下文管理
Teknium 🪽
转发 @tonysimons_:Hermes 智能体每日小贴士:🪽

如果你在 Hermes 上运行 GPT-5.6,有一个全新设置你应该了解。

Hermes 现在可以使用 OpenAI 的原生 Responses API 进行服务端压缩,用于长时间运行的会话。

开启方法:

compression:
codex_responses_native: true

妙处在于:

Hermes 不必再本地压缩庞大的对话,OpenAI 可以先在服务端压缩较旧的上下文。

Hermes 会保留加密的压缩检查点,并在未来的轮次中重放。

因此你会获得:

→ 更好的长会话上下文管理
→ 跨轮次的持久压缩
→ 减少不必要的转录负担
→ Hermes 正常的本地压缩仍作为后备方案

而且这个功能并不会在所有提供商上盲目启用。

它专门针对通过直接 OpenAI API 或你的 ChatGPT Codex 订阅运行的 GPT-5.6。

OpenRouter、xAI、Copilot、本地模型等,不会强行塞入这个字段然后说“祝你好运”。😂

这个功能昨天上线。

如果你在长时编码或智能体工作流中使用 Hermes 搭配 GPT-5.6,我绝对建议试试。🤘🏻
动态Teknium 🪽2026-08-09原文

相关内容