测试多个模型时编排器管理困难,考虑自建控制流 Victor M使用Kimi K3、Qwen3.8等模型,我想在所有基准测试上测试所有模型,但管理起来越来越困难……我的流程是让一个编排器(如Hermes或OpenClaw)管理数百个agent会话,但它会丢失跟踪且运行不佳。你用什么?认真考虑构建自己的控制流,可以插入到现有agent中: 动态Victor M2026-07-20原文 打开互动版