python缺失值解决方案

知行编程网 2022-10-07 12:30 知行编程网 | 隐藏边栏 | 12 0

文章评分 0 次，平均分 0.0 ：

导语：本文主要介绍了关于python缺失值的解决方法的相关知识，包括python用均值填充缺失值，以及python含有缺失值的均值这些编程知识，希望对大家有参考作用。

解决方法

1、忽视元组。

这通常在缺少类标签时进行（假设挖掘任务与分类相关）并且效果较差，除非元组具有多个属性的缺失值。当每个属性的缺失值百分比变化很大时，它的性能特别差。

2、人工填写缺失值。

一般来说，这种方法耗时较长，在数据集较大且缺失值较多的情况下可能无法实现。

3、使用全局常量填充缺失值。

用相同的常数（如未知或负数）替换缺失的属性值。如果将缺失值替换为未知，挖掘程序可能会认为形成了一个有趣的概念。因为有相同的值未知。因此，这种方法简单但不可靠。

4. 使用与给定元组相同类型的所有样本的属性均值。

5、使用最可能的值填充缺失值。

它可以通过回归、使用贝叶斯形式化的基于推理的工具和决策树的总结来决定。

实例

import numpy as np
 
from sklearn.preprocessing import Imputer
 
imp = Imputer(missing_values='NaN', strategy='mean', axis=0)
 
import numpy as np
from sklearn.preprocessing import Imputer
 
###1.使用均值填充缺失值
imp = Imputer(missing_values='NaN', strategy='mean', axis=0)
imp.fit([[1, 2], [np.nan, 3], [7, 6]])
 
X = [[np.nan, 2], [6, np.nan], [7, 6]]
print(imp.transform(X))  
[[4.         2.        ]
 [6.         3.66666667]
 [7.         6.        ]]

本文教程操作环境：windows7系统、Python 3.9.1，DELL G3电脑。

python

本文为原创文章，版权归知行编程网所有，欢迎分享本文，转载请保留出处！

知行编程网关注：1 粉丝：1

这个人很懒，什么都没写

内容反馈

你可能也喜欢

热评文章

联系我们

标签云

推广返利