24.1 数据飞轮:合成、筛选、主动学习与治理#

现代大模型的能力增长日益不再依赖等待下一批人类数据,而依赖一个自持续运转的闭环:模型上线服务并采集真实交互与反馈,将其筛选为新的训练数据,训练出更强的模型,更强的模型又生成更高质量的数据。该闭环的产出质量取决于其运转速度与数据洁净度;一旦混入脏数据或长期以模型自身输出为唯一训练来源,闭环会停止增益甚至发生退化。

登录后才可看