Python 代码详解:计算 Excel 文件中每列缺失值数量
这段代码使用 Python 读取名为 'incom.xlsx' 的 Excel 文件,并计算每个列中缺失值的数量。
代码解释:
import numpy as np
import pandas as pd
import seaborn as sns
income = pd.read_excel(r'D:\incom.xlsx')
income.apply(lambda x:np.sum(x.isnull()))
-
导入库: 代码首先导入了三个 Python 库:
numpy用于数值计算。pandas用于数据处理和分析,特别是处理数据框。seaborn用于数据可视化。
-
读取 Excel 文件:
income = pd.read_excel(r'D:\incom.xlsx')读取名为 'incom.xlsx' 的 Excel 文件,并将数据存储在名为income的 Pandas 数据框中。 -
计算缺失值:
income.apply(lambda x:np.sum(x.isnull()))使用apply函数将一个lambda表达式应用于income数据框的每一列。lambda x:np.sum(x.isnull())是一个匿名函数,它接收数据框的一列作为输入 (x)。x.isnull()返回一个布尔型数据框,其中True表示该位置的值缺失,False表示该位置的值存在。np.sum()计算布尔型数据框中True值的总和,即缺失值的总数量。
最终,代码返回一个数据框,其中每个列的值代表该列中缺失值的总数量。
原文地址: https://www.cveoy.top/t/topic/o0hs 著作权归作者所有。请勿转载和采集!