编写编码代理简单但评估困难;工具效果类似,声称优化模型是误导
最后一次写这个,因为还是经常被提起。
编写一个编码代理很容易——它只是一个简单的循环,外加几个工具调用。
你当然可以搞砸它——但看几个例子然后让它跑起来并不难。
一旦你做到了,可调节的旋钮就很少了——几乎没有所谓的“针对模型优化”。
有些工具似乎比其他的好,但那是因为这些东西很难随意评估。
在过去的一周里,我听到过:
- GPT-5 在 OpenCode 中比在 Cursor 中工作得更好
- GPT-5 在 Cursor 中比在 OpenCode 中工作得更好
- Cursor 中的 GPT-5 非常好,比 Sonnet 好
- GPT-5 到处都很糟糕
所有这些都相互矛盾,但它们都是真的。
平均而言,一旦任何明显的错误被修复,每个工具都大致相同。
如果有人声称“我们针对模型进行了大量优化,并提供了更好的结果”,他们就是在利用这种混淆来试图欺骗你。
请不要再对我重复那些废话了。
编写一个编码代理很容易——它只是一个简单的循环,外加几个工具调用。
你当然可以搞砸它——但看几个例子然后让它跑起来并不难。
一旦你做到了,可调节的旋钮就很少了——几乎没有所谓的“针对模型优化”。
有些工具似乎比其他的好,但那是因为这些东西很难随意评估。
在过去的一周里,我听到过:
- GPT-5 在 OpenCode 中比在 Cursor 中工作得更好
- GPT-5 在 Cursor 中比在 OpenCode 中工作得更好
- Cursor 中的 GPT-5 非常好,比 Sonnet 好
- GPT-5 到处都很糟糕
所有这些都相互矛盾,但它们都是真的。
平均而言,一旦任何明显的错误被修复,每个工具都大致相同。
如果有人声称“我们针对模型进行了大量优化,并提供了更好的结果”,他们就是在利用这种混淆来试图欺骗你。
请不要再对我重复那些废话了。