引述AI模型调优实验,所有改进可迁移
未来/现状一瞥
三天前,我让autoresearch在depth=12模型上调优nanochat约2天。它发现了约20个改善验证损失的更改。我昨天测试了这些更改,所有都是可加性的,并迁移到了更大(depth=24)的模型。堆叠所有这些更改,https://t.co/j34dSt4oht
三天前,我让autoresearch在depth=12模型上调优nanochat约2天。它发现了约20个改善验证损失的更改。我昨天测试了这些更改,所有都是可加性的,并迁移到了更大(depth=24)的模型。堆叠所有这些更改,https://t.co/j34dSt4oht