动态

新增prompt-audit命令,修复提示词反模式以提升模型性能。

新增prompt-audit命令,修复提示词反模式以提升模型性能。
Lance Martin
我最近向claude-api技能添加了这个命令。在Claude Code中运行它可修复常见的提示词“反模式”,这些模式会削弱前沿模型的能力:

/claude-api prompt-audit

模式包括:

1/ 验证仪式。像“double-check your work”或“verify twice before responding”这类指令通常被前沿模型字面理解,可能浪费token。

2/ 详尽性和强调增强词。“Be maximally thorough”“CRITICAL: YOU MUST ALWAYS…“在处理前沿模型时可能导致冗长和额外的工具调用。

3/ 强制流程和草稿纸脚手架。固定步骤流程(例如“think step by step in a scratchpad”)或推理模板是前沿模型不需要的仪式。这些脚手架可能叠加在本机推理之上,消耗不必要的token。

4/ 过时的示例。针对旧模型失败模式调优的少样本示例可能教会前沿模型在不需要的请求上模仿长推理链。

5/ 矛盾规则。前沿模型更擅长遵循指令。矛盾指令(“始终在政策范围内退款”vs“未经升级绝不退款”)可能被前沿模型更字面地遵循,导致性能下降。

6/ 过时的配置。为较旧Claude代编写的设置(如手动思考预算)可能被新版模型的Claude平台拒绝。

这些模式会随时间累积在提示词中,在升级到新模型时可能悄悄降低性能。一个常见原因是前沿模型更擅长遵循指令,因此这些反模式会引导它们花费不必要的token。

示例:我在内部客户支持基准测试上测试了从Opus 4.8迁移到Opus 5的过程。在Opus 5(及其他前沿模型如Fable 5.1)上,验证仪式(“verify twice”)通过重复工作浪费不必要的token。强调增强词(“be maximally thorough”)变成了数十次不必要的搜索。

应用提示审计可以提高性能并降低成本(如所附示例所示,很快将分享完整文章)。

此外,该技能也是开源的,其中一些指导可能普遍适用于前沿模型
https://t.co/4rv1lfiDiz

https://t.co/iLbvKfnTH3
动态Lance Martin2026-09-02原文

相关内容