动态

探讨agent代码质量与工作有效性

jason
对于智能体工作,“只要能用谁在乎代码长什么样”这种思路的问题在于,它假设智能体对“能用”有完美的理解。实际上,事物往往定义不足,智能体会做出错误假设等等。
平心而论,智能体在单元测试覆盖率方面相当不错,但在设计人类体验(如 API、CLI 标志等)方面很差,尤其是为未来路线图设计连贯的体验(除非你的待办事项完美且愿景完整,我怀疑)。它们不知道性能在何处重要以及何种类型(CPU 与内存权衡)。它们不知道兼容性在何处重要以及何处不重要(并倾向于在没有进一步指导时保留兼容性)。等等。
除非你把这些都明确说明,否则不可能不看一眼就声称“它能工作”。
动态jason2026-06-15原文

相关内容