1. 首页
  2. 数据库
  3. 其它
  4. 过拟合/欠拟合梯度消失和爆炸概念

过拟合/欠拟合梯度消失和爆炸概念

上传者: 2021-02-01 07:13:47上传 PDF文件 74.82KB 热度 14次
在解释过拟合/欠拟合之前,我们需要区分训练误差(training error)和泛化误差(generalization error)。通俗来讲,前者指模型在训练数据集上表现出的误差,后者指模型在任意一个测试数据样本上表现出的误差的期望,并常常通过测试数据集上的误差来近似。计算训练误差和泛化误差可以使用之前介绍过的损失函数,例如线性回归用到的平方损失函数和softmax回归用到的交叉熵损失函数。 验证数据集 从严格意义上讲,测试集只能在所有超参数和模型参数选定后使用一次。不可以使用测试数据选择模型,如调参。由于无法从训练误差估计泛化误差,因此也不应只依赖训练数据选择模型。鉴于此,我们可以预留一部
用户评论