标签:
同类数据具有一定的统计规律性。
随机变量->数据特征;概率分布->数据规律
步骤如下:
过拟合——学习时选择的模型所包含的参数过多,以至于出现这一模型对已知数据预测得很好,但对未知数据预测得很差的现象。
M次多项式函数拟合问题
泛化能力——指学习方法对未知数据的预测能力。
选择经验风险与模型复杂度同时较小的模型。
交叉验证
把给定的数据进行切分,将切分的数据集组合为训练集和测试集,在此基础上反复地进行训练、测试以及模型选择。
分类问题
分类——分类器对新的输入进行输出的预测,输出变量Y取有限个离散值。
预测正类数 |
预测负类数 |
|
实际正类数 |
TP |
FN |
实际负类数 |
FP |
TN |
标签:
原文地址:http://www.cnblogs.com/sweetyu/p/5085144.html