任务混合与负迁移审计台
把任务采样、损失权重、损失尺度和最终指标拆开看。平均分上涨,不代表每个任务都得到了帮助。
训练混合:谁更常出现,谁的更新更响
| 任务 | 样本量 | 损失尺度 | 静态权重 | 采样概率 | 有效影响(示意) |
|---|
采样概率按 nα 的直觉计算:α=0 接近任务均匀,α=1 接近按样本量。有效影响还乘上损失尺度与权重,所以“抽得少”不一定“影响小”。
评估审计:逐任务对照单任务基线
—单任务宏平均
—多任务宏平均
把任务采样、损失权重、损失尺度和最终指标拆开看。平均分上涨,不代表每个任务都得到了帮助。
| 任务 | 样本量 | 损失尺度 | 静态权重 | 采样概率 | 有效影响(示意) |
|---|
采样概率按 nα 的直觉计算:α=0 接近任务均匀,α=1 接近按样本量。有效影响还乘上损失尺度与权重,所以“抽得少”不一定“影响小”。