服装网站建设费用分析,最近的军事新闻有哪些,wordpress 文件管理插件,万户网络是干嘛的数据的缺失主要包括记录的缺失和记录中某个字段信息的缺失#xff0c;两者都会造成分析结果的不准确#xff0c;以下从缺失值产生的原因及影响等方面展开分析。(1)缺失值产生的原因1)有些信息暂时无法获取#xff0c;或者获取信息的代价太大。2)有些信息是被遗漏的。可能是因…数据的缺失主要包括记录的缺失和记录中某个字段信息的缺失两者都会造成分析结果的不准确以下从缺失值产生的原因及影响等方面展开分析。(1)缺失值产生的原因1)有些信息暂时无法获取或者获取信息的代价太大。2)有些信息是被遗漏的。可能是因为输入时认为不重要、忘记填写或对数据理解错误等一些人为因素而遗漏也可能是由于数据采集设备的故障、存储介质的故障、传输媒体的故障等非人为原因而丢失。3)属性值不存在。在某些情况下缺失值并不意味着数据有错误。对一些对象来说某些属性值是不存在的如一个未婚者的配偶姓名、一个儿童的固定收入等。(2)缺失值的影响1)数据挖掘建模将丢失大量的有用信息。2)数据挖掘模型所表现出的不确定性更加显著模型中蕴涵的规律更难把握。3)包含空值的数据会使建模过程陷入混乱导致不可靠的输出。(3)缺失值的分析使用简单的统计分析可以得到含有缺失值的属性的个数以及每个属性的未缺失数、缺失数与缺失率等。从总体上来说缺失值的处理分为删除存在缺失值的记录、对可能值进行插补和不处理3种情况将在4.1.1节详细介绍。