Claude更新:预写代码实现复杂函数调用,提升agent效率
Claude 获得了一个巨大的隐藏更新。我的天。
以前:
用户提示 -> Claude -> 使用工具 -> Claude
现在:
用户提示 -> Claude -> 编写代码和逻辑 -> 该代码使用工具 -> 代码逻辑可以解析或格式化结果,添加条件逻辑并多次使用工具 -> Claude
这解锁了极其复杂的函数调用。
例如,假设你正在查询数据库。以前你会进行一次查询,然后 Claude 读取结果,如果需要再查询一次。现在 Claude 编写代码来调用工具,然后该代码可以处理结果并执行不同操作,比如再次查询、剥离或格式化数据,并根据工具调用结果改变操作,所有这些都在返回给 Claude 之前完成。Claude 编写的代码预先规划了如何对工具结果做出反应。
这压缩了 LLM agent 循环,因为 agent 不需要实时决策,也不需要一直请求 LLM 做决定,相反 LLM 预先烘焙了可能数百或数千条决策路径。
如果我们在 agent 循环和工具调用效率指标上最终看到 2 倍到 100 倍甚至更多的改进,我不会感到惊讶。
微妙但绝对巨大的变化。
以前:
用户提示 -> Claude -> 使用工具 -> Claude
现在:
用户提示 -> Claude -> 编写代码和逻辑 -> 该代码使用工具 -> 代码逻辑可以解析或格式化结果,添加条件逻辑并多次使用工具 -> Claude
这解锁了极其复杂的函数调用。
例如,假设你正在查询数据库。以前你会进行一次查询,然后 Claude 读取结果,如果需要再查询一次。现在 Claude 编写代码来调用工具,然后该代码可以处理结果并执行不同操作,比如再次查询、剥离或格式化数据,并根据工具调用结果改变操作,所有这些都在返回给 Claude 之前完成。Claude 编写的代码预先规划了如何对工具结果做出反应。
这压缩了 LLM agent 循环,因为 agent 不需要实时决策,也不需要一直请求 LLM 做决定,相反 LLM 预先烘焙了可能数百或数千条决策路径。
如果我们在 agent 循环和工具调用效率指标上最终看到 2 倍到 100 倍甚至更多的改进,我不会感到惊讶。
微妙但绝对巨大的变化。
今天发布中一个被低估的开发者升级:
Claude 的网络搜索和抓取工具现在会编写并执行代码,在结果到达上下文窗口之前进行过滤。
启用后,Sonnet 4.6 在 BrowseComp 上的准确率提高了 13%,同时输入 token 减少了 32%。