Hermes Agent 的8个关键配置优化,节省token并提升输出
HERMES AGENT 有8个配置项
大多数用户从不更改。
每个都节省 token、改善输出,或两者兼有。
1. 推理努力度
控制每轮思考量。
默认:中等。
agent:
reasoning_effort: low
选项:none, minimal, low, medium, high, xhigh。
常规cron任务:low。深度分析:high。
使用 /reasoning [level] 在会话中切换。
努力度越低 = token越少 = 轮次成本越低。
2. 子代理模型覆盖
子代理默认使用你的主模型。
在Opus上运行的网页搜索子代理是浪费。
delegation:
model: "deepseek/deepseek-v4"
简单任务用廉价模型。
父代理保持使用你的高级模型。
一个配置,显著节省。
3. YOLO模式
跳过每个操作的权限提示。
approvals:
mode: off
或使用启动:hermes --yolo
三种模式:
→ manual:批准所有(默认)
→ smart:自动批准低风险,提示高风险
→ off:跳过所有提示
日常使用smart。
完全信任任务时用off。
绝不在生产系统上使用。
4. 记忆限制
memory.md 上限 2200 字符。
user.md 上限 1375 字符。
超出后,代理会丢弃它认为最不重要的内容。
memory:
memory_char_limit: 2200
user_char_limit: 1375
如果代理持续遗忘重要上下文,请提高这些值。
5. 快速命令
在 config.yaml 中两种类型:
EXEC(运行终端命令,输出放入上下文):
quick_commands:
git-status:
type: exec
command: "git status && git log --oneline -5"
ALIAS(重命名现有命令):
quick_commands:
c:
type: alias
target: compress
/git-status 和 /c 成为即时快捷方式。
所有设置:桌面应用、仪表盘或 config.yaml。
评论 CONFIG 我会发送给你
剩余3个控制压缩行为和工具输出限制的设置。
文章中有完整的15层分解 👇
大多数用户从不更改。
每个都节省 token、改善输出,或两者兼有。
1. 推理努力度
控制每轮思考量。
默认:中等。
agent:
reasoning_effort: low
选项:none, minimal, low, medium, high, xhigh。
常规cron任务:low。深度分析:high。
使用 /reasoning [level] 在会话中切换。
努力度越低 = token越少 = 轮次成本越低。
2. 子代理模型覆盖
子代理默认使用你的主模型。
在Opus上运行的网页搜索子代理是浪费。
delegation:
model: "deepseek/deepseek-v4"
简单任务用廉价模型。
父代理保持使用你的高级模型。
一个配置,显著节省。
3. YOLO模式
跳过每个操作的权限提示。
approvals:
mode: off
或使用启动:hermes --yolo
三种模式:
→ manual:批准所有(默认)
→ smart:自动批准低风险,提示高风险
→ off:跳过所有提示
日常使用smart。
完全信任任务时用off。
绝不在生产系统上使用。
4. 记忆限制
memory.md 上限 2200 字符。
user.md 上限 1375 字符。
超出后,代理会丢弃它认为最不重要的内容。
memory:
memory_char_limit: 2200
user_char_limit: 1375
如果代理持续遗忘重要上下文,请提高这些值。
5. 快速命令
在 config.yaml 中两种类型:
EXEC(运行终端命令,输出放入上下文):
quick_commands:
git-status:
type: exec
command: "git status && git log --oneline -5"
ALIAS(重命名现有命令):
quick_commands:
c:
type: alias
target: compress
/git-status 和 /c 成为即时快捷方式。
所有设置:桌面应用、仪表盘或 config.yaml。
评论 CONFIG 我会发送给你
剩余3个控制压缩行为和工具输出限制的设置。
文章中有完整的15层分解 👇