论证模型不能内化工具,需Harness执行真实操作
这两天都在测试 Astra,各种 Astra 操作 Blender 的炫酷案例,但这恰恰证明:不是 Codex 驾驭不了 Astra,而是 Astra 离不开 Codex 这个 Harness。
如果没有 Codex 这层 Harness,Astra 再怎么内化,它也不能自己打开电脑、跑起 Blender 建模。
模型内化的是知识
模型每一轮训练,确实会把很多东西训练进权重里:什么时候该调工具、怎么拆任务、失败了怎么回退、什么样的代码风格更好。这些是策略和判断,是可以内化的。所以 Astra 不需要你写一大堆提示词教它怎么操作 Blender,它自己就知道。
但模型本身能做的只有一件事:根据输入的 Prompt 输出 Token。
它说“我要在某个位置画一条线”,这只是一段文字。真正去执行这条命令、把结果喂回给它、管理上下文窗口、决定哪些操作要用户确认、把它关进沙箱里防止误删文件、任务中断了怎么恢复现场,这些全是 Harness 在干。
所以“Harness 被模型内化了”这个说法是把两件事混在一起了。Harness 这一层没办法内化,因为它压根不在模型的输入输出里,你没法把“工具”训练进权重,只能训练“如何操作工具”。
换句话说:可以内化的是“如何操作工具”,而“工具本身”是不能被内化的。
就像一个人开车技术再好,把驾驶经验内化得再深,你把车拿走,他也只能在原地比划方向盘。
模型变强,对 Harness 确实有影响。
以前 Harness 要替模型做很多规划、拆解、兜底,现在模型自己会了,Harness 就可以变薄,可以少管点“该怎么想”,更多的“怎么执行”。
反过来,模型越强,想用的工具越多、想干的事越复杂,对 Harness 的执行能力、权限控制、状态管理要求反而更高。
所以也不存在“Codex 驾驭不了 Astra”,是模型通过 Harness 驾驭电脑。如果 Astra 的能力超出了 Codex 现有的设计,那说明 Codex 该升级了,但不意味着说 Harness 这一层可以不要了。
模型和 Harness 从来是相辅相成,不是谁替代谁。
模型是大脑,Harness 是手脚。大脑再聪明,也得靠手脚才能碰到真实世界。
如果没有 Codex 这层 Harness,Astra 再怎么内化,它也不能自己打开电脑、跑起 Blender 建模。
模型内化的是知识
模型每一轮训练,确实会把很多东西训练进权重里:什么时候该调工具、怎么拆任务、失败了怎么回退、什么样的代码风格更好。这些是策略和判断,是可以内化的。所以 Astra 不需要你写一大堆提示词教它怎么操作 Blender,它自己就知道。
但模型本身能做的只有一件事:根据输入的 Prompt 输出 Token。
它说“我要在某个位置画一条线”,这只是一段文字。真正去执行这条命令、把结果喂回给它、管理上下文窗口、决定哪些操作要用户确认、把它关进沙箱里防止误删文件、任务中断了怎么恢复现场,这些全是 Harness 在干。
所以“Harness 被模型内化了”这个说法是把两件事混在一起了。Harness 这一层没办法内化,因为它压根不在模型的输入输出里,你没法把“工具”训练进权重,只能训练“如何操作工具”。
换句话说:可以内化的是“如何操作工具”,而“工具本身”是不能被内化的。
就像一个人开车技术再好,把驾驶经验内化得再深,你把车拿走,他也只能在原地比划方向盘。
模型变强,对 Harness 确实有影响。
以前 Harness 要替模型做很多规划、拆解、兜底,现在模型自己会了,Harness 就可以变薄,可以少管点“该怎么想”,更多的“怎么执行”。
反过来,模型越强,想用的工具越多、想干的事越复杂,对 Harness 的执行能力、权限控制、状态管理要求反而更高。
所以也不存在“Codex 驾驭不了 Astra”,是模型通过 Harness 驾驭电脑。如果 Astra 的能力超出了 Codex 现有的设计,那说明 Codex 该升级了,但不意味着说 Harness 这一层可以不要了。
模型和 Harness 从来是相辅相成,不是谁替代谁。
模型是大脑,Harness 是手脚。大脑再聪明,也得靠手脚才能碰到真实世界。
@dotey 我觉得codex已经驾驭不了astra了,coding harness已经内化了!