动态

引述AI模型调优实验,所有改进可迁移

引述AI模型调优实验,所有改进可迁移
Kevin Weil
未来/现状一瞥
Andrej Karpathy
三天前,我让autoresearch在depth=12模型上调优nanochat约2天。它发现了约20个改善验证损失的更改。我昨天测试了这些更改,所有都是可加性的,并迁移到了更大(depth=24)的模型。堆叠所有这些更改,https://t.co/j34dSt4oht
动态Kevin Weil2026-03-10原文

相关内容