python_如何观察数据分布_describe(python数据分布图)

网友投稿 433 2022-08-24


python_如何观察数据分布_describe(python数据分布图)

如何观察数据分布_describe

train.head(5) #显示前5行数据train.tail(5) #显示后5行train.columns #查看列名train.info() #查看各字段的信息train.shape #查看数据集行列分布,几行几列train.describe() #查看数据的大体情况

从上面的描述性统计可以看出两点:**正偏态离散程度**1)所有的特征都是正倾斜的,最大值是平均数的几倍。 2)离散系数(coefficient of variation,或变异系数)非常高,接近甚至超过1,说明数据的离散程度很大,波动范围很大。备注:正倾斜(positively skewed): 平均数 > 中位数,由于数据中有些很大很大的极端值,使得整体平均数被极少数的极端大值拉大了,俗称“被平均”,而中位数受极端值的影响其实很小,因而此时用中位数作为中心趋势的估计比较稳健。负倾斜:同理。离散系数 = 标准差 /


版权声明:本文内容由网络用户投稿,版权归原作者所有,本站不拥有其著作权,亦不承担相应法律责任。如果您发现本站中有涉嫌抄袭或描述失实的内容,请联系我们jiasou666@gmail.com 处理,核实后本网站将在24小时内删除侵权内容。

上一篇:python数据结构的遍历操作(Python的遍历循环中的遍历结构可以是哪些数据结构?)
下一篇:springboot的四种启动方式
相关文章

 发表评论

暂时没有评论,来抢沙发吧~