当前位置:网站首页>彻底搞懂箱形图分析
彻底搞懂箱形图分析
2022-08-04 05:28:00 【我很好请走开谢谢】
学习于 这篇文章
文章目录
一、箱形图
箱形图(英文:Box plot),又称为盒须图、盒式图、盒状图或箱线图,是一种用作显示一组数据分散情况资料的统计图。因型状如箱子而得名。在各种领域也经常被使用,常见于品质管理,快速识别异常值。
箱形图最大的优点就是不受异常值的影响,能够准确稳定地描绘出数据的离散分布情况,同时也利于数据的清洗。
想要搞懂箱形图,那么一定要了解…
二、五大因“数”
我们一组序列数为例:12,15,17,19,20,23,25,28,30,33,34,35,36,37讲解这五大因“数”。

1、下四分位数Q1
(1)确定四分位数的位置。Qi所在位置=i(n+1)/4,其中i=1,2,3。n表示序列中包含的项数。
(2)根据位置,计算相应的四分位数。
例中:
Q1所在的位置=(14+1)/4=3.75,
Q1=0.25×第三项+0.75×第四项=0.25×17+0.75×19=18.5;
2、中位数(第二个四分位数)Q2
中位数,即一组数由小到大排列处于中间位置的数。若序列数为偶数个,该组的中位数为中间两个数的平均数。
例中:
Q2所在的位置=2(14+1)/4=7.5,
Q2=0.5×第七项+0.5×第八项=0.5×25+0.5×28=26.5
3、上四分位数Q3
计算方法同下四分位数。
例中:
Q3所在的位置=3(14+1)/4=11.25,
Q3=0.75×第十一项+0.25×第十二项=0.75×34+0.25×35=34.25。
4、上限
上限是非异常范围内的最大值。
首先要知道什么是四分位距如何计算的?
四分位距IQR=Q3-Q1,那么上限=Q3+1.5IQR
5、下限
下限是非异常范围内的最小值。
下限=Q1-1.5IQR
三、箱形图的价值
1.直观明了地识别数据批中的异常值
上文讲了很久的识别异常值,其实箱线图判断异常值的标准以四分位数和四分位距为基础,四分位数具有一定的耐抗性,多达25%的数据可以变得任意远而不会很大地扰动四分位数,所以异常值不会影响箱形图的数据形状,箱线图识别异常值的结果比较客观。由此可见,箱线图在识别异常值方面有一定的优越性。
2.利用箱线图判断数据批的偏态和尾重
对于标准正态分布的样本,只有极少值为异常值。异常值越多说明尾部越重,自由度越小(即自由变动的量的个数);
而偏态表示偏离程度,异常值集中在较小值一侧,则分布呈左偏态;异常值集中在较大值一侧,则分布呈右偏态。
3.利用箱线图比较几批数据的形状
同一数轴上,几批数据的箱线图并行排列,几批数据的中位数、尾长、异常值、分布区间等形状信息便昭然若揭。如上图,可直观得看出第三季度各分公司的销售额大体都在下降。
但箱形图也有他的局限性,比如:不能精确地衡量数据分布的偏态和尾重程度;对于批量比较大的数据,反映的信息更加模糊以及用中位数代表总体评价水平有一定的局限性。
边栏推荐
- flink问题整理
- BUUCTF——MISC(一)
- Zend FrameWork RCE1
- TensorFlow:tf.ConfigProto()与Session
- 跨域问题的解决
- postgresql 游标(cursor)的使用
- 剑指 Offer 2022/7/4
- MySql的concat和group_concat的区别
- (TensorFlow)——tf.variable_scope和tf.name_scope详解
- npm install dependency error npm ERR! code ENOTFOUNDnpm ERR! syscall getaddrinfonpm ERR! errno ENOTFOUND
猜你喜欢
随机推荐
自己学习爬虫写的基础小函数
Redis持久化方式RDB和AOF详解
yolov3中数据读入(一)
原型对象及原型链的理解
WARNING: sql version 9.2, server version 11.0.Some psql features might not work.
Programming hodgepodge (3)
(十六)图的基本操作---两种遍历
SQL练习 2022/7/5
编程Go:return、break、continue
进入古诗文网站个人中心,绕过登录
flink-sql所有表格式format
Linux环境下redis的下载、安装和启动(建议收藏)
Shell(3)条件控制语句
SQL练习 2022/7/2
Kubernetes基本入门-名称空间资源(三)
scrapy 爬取当当图书名字图片
组原模拟题
Kubernetes基本入门-元数据资源(四)
sql中group by的用法
Zend FrameWork RCE1









