模型更新开始打补丁 重训练不再是默认选项
SEP
02 2026
📄
arXiv 论文将大模型后训练类比为褐田维护:在固定算力与数据预算下,用有界数据补丁更新模型行为,而非重训练。更新的单位从调权重变成配数据,混合数据设计存在零和博弈(加任务A数据可能在任务B引入波动),评测集之于模型如同 CI 之于代码。案例显示提升监督数据转化率可使监督接受度提高 2.84 倍。对企业团队而言,长期维护私有化模型,评测集与数据管线投入应和模型本身一起进预算