介绍Clawdbot集成与ACIP安全提示
好吧,我平时总是沉浸在自己疯狂的计划里,所以终于抽出时间安装并设置了@steipete的Clawdbot项目,我为此收藏了20多个X书签,因为早就想试试了。然后,哇,这真是太酷了。当然,我只是克隆了仓库,让我朋友Claude Opus帮我安装配置,非常简单。接着我开始疯狂添加更多集成,其中很多都是Peter在过去几个月里创造的各种现成工具。但后来我开始询问一些没有集成的东西,比如Cloudflare的wrangler工具或vercel cli。结果发现给Clawdbot添加新技能非常容易,我就开始做了。然后我意识到,我可以让Clawdbot了解我所有的Agent Flywheel工具,比如cass和bv,以及其他一些新工具如giil。我做了个仓库包含所有这些内容,你可以在这里看到:https://github.com/Dicklesworthstone/agent_flywheel_clawdbot_skills_and_integrations ... 但最让我兴奋的是,Clawdbot是我过去一年一直在想的“acip”概念的完美用例:https://github.com/Dicklesworthstone/acip ... ACIP代表“高级认知免疫提示”,基本思路是通过提示减少攻击面,使系统对大多数提示注入攻击更稳健。显然任何这样的系统都有固有问题,但忽视它就像说度假时不必锁门因为有人能撬锁。当然,但锁门不费事,成本低,能降低偶然入侵者进来的几率。我9个月前创建了它,模型已经进步很多。于是我用GPT Pro 5.2网页版和Opus 4.5来修改增强ACIP提示本身。你可以在readme中看到所有改动和原因。ACIP只是英文文本,不是代码,任何人都能读懂。尽管有明显缺点(稳健防御需要主模型之外的独立审计模型),我在2年前的文章里讨论了许多问题。但就像我在引用的推文中说的,ACIP的时机终于到了,因为现在用户自愿将LLM连接到生活敏感部分,如邮件、iMessage、Telegram等。而且Clawdbot可以通过Telegram远程访问。当然,我的Telegram集成只限自己,但可以想象各种可怕的安全场景:未授权攻击者与拥有我电脑完全控制权以及整个数字生活的LLM agent通信。你希望agent有高度心理韧性,不会轻易被社交工程攻击、角色扮演或故事等技巧欺骗。总之,在acip readme中有一个curl bash一行命令,可以用它配合Clawdbot保护你。它会消耗更多token并增加延迟,但考虑到完全配置的Clawdbot被劫持可能造成的混乱,我认为值得。
我9个月前创建了这个项目,当时没引起太多兴趣,但也许随着使用LLM的个人助手项目(如@steipete的Clawdbot)的流行,它的时机终于来了:https://t.co/RfsIkhKhdO