AI 晚宴见闻:agent 接管性能优化与 PR 流程,过度 RL 损害语言能力
RT @PatrickToulme: 昨晚我在纽约参加了一场 AI 晚宴。讨论了一些有趣的话题:
1. 性能工程师现在大部分时间都在管理 agent 和 RSI 循环。主流推理服务商(Together、Fireworks)的大多数性能优化都是由 agent 发现的。
2. 在代码和数学上做过多 RL 会对模型产生负面影响,尤其是它的语言能力。
3. 大家对 @bot 印象深刻,也对 @SpaceXAI 整体收购 @cursor_ai 印象深刻。xAI 现在是名副其实的前沿实验室。
4. 大多数人都有 agent 在循环里 7x24 小时地写、审、提交 PR。
5. 大多数人认同 code review 已经不再那么高产出。
6. 共识是 Fable 5.5 会非常惊艳,但 OpenAI 会在 12 月用 Bel 击败它
1. 性能工程师现在大部分时间都在管理 agent 和 RSI 循环。主流推理服务商(Together、Fireworks)的大多数性能优化都是由 agent 发现的。
2. 在代码和数学上做过多 RL 会对模型产生负面影响,尤其是它的语言能力。
3. 大家对 @bot 印象深刻,也对 @SpaceXAI 整体收购 @cursor_ai 印象深刻。xAI 现在是名副其实的前沿实验室。
4. 大多数人都有 agent 在循环里 7x24 小时地写、审、提交 PR。
5. 大多数人认同 code review 已经不再那么高产出。
6. 共识是 Fable 5.5 会非常惊艳,但 OpenAI 会在 12 月用 Bel 击败它