boxplot--盒图
来源:互联网 发布:origin导入excel数据 编辑:程序博客网 时间:2024/04/29 20:52
转载自 http://www.blogjava.net/norvid/articles/317235.html
盒图(boxplot),对于显示数据的离散的分布情况效果不错。
盒图是在1977年由美国的统计学家约翰·图基(John Tukey)发明的。它由五个数值点组成:最小值(min),下四分位数(Q1),中位数(median),上四分位数(Q3),最大值(max)。也可以往盒图里面加入平均值(mean)。如上图。下四分位数、中位数、上四分位数组成一个“带有隔间的盒子”。上四分位数到最大值之间建立一条延伸线,这个延伸线成为“胡须(whisker)”。
由于现实数据中总是存在各式各样地“脏数据”,也成为“离群点”,于是为了不因这些少数的离群数据导致整体特征的偏移,将这些离群点单独汇出,而盒图中的胡须的两级修改成最小观测值与最大观测值。这里有个经验,就是最大(最小)观测值设置为与四分位数值间距离为1.5个IQR(中间四分位数极差)。即
- IQR = Q3-Q1,即上四分位数与下四分位数之间的差,也就是盒子的长度。
- 最小观测值为min = Q1 - 1.5*IQR,如果存在离群点小于最小观测值,则胡须下限为最小观测值,离群点单独以点汇出。如果没有比最小观测值小的数,则胡须下限为最小值。
- 最大观测值为max = Q3 -1.5*IQR,如果存在离群点大于最大观测值,则胡须上限为最大观测值,离群点单独以点汇出。如果没有比最大观测值大的数,则胡须上限为最大值。
通过盒图,在分析数据的时候,盒图能够有效地帮助我们识别数据的特征:
- 直观地识别数据集中的异常值(查看离群点)。
- 判断数据集的数据离散程度和偏向(观察盒子的长度,上下隔间的形状,以及胡须的长度)。
0 0
- 盒图(boxplot)
- boxplot--盒图
- Boxplot(盒图)
- matlab: 盒图---boxplot
- matlab: 盒图---boxplot
- R boxplot
- boxplot analysis
- 画箱形图(boxplot)
- 什么是箱线图(boxplot)
- 盒须图(Boxplot)
- matlab常用函数-boxplot
- pie hist plot boxplot
- Matlab箱形图boxplot函数用法
- scatter_matrix&df.plot&sns.boxplot
- matlab boxplot 设置 xticklabel失败
- R语言中的箱图介绍 boxplot
- Python 绘制 误差 箱线图 error boxplot
- 用pandas绘制箱体图(boxplot)
- leetcode#215 Kth Largest Element in an Array
- 1005--Java集合--Map接口
- 音乐播放器
- C语言中可变参数的用法
- Introduce to algorithm-----pseudo code to C/C++ code (chapter 11)
- boxplot--盒图
- Sizeof与Strlen的区别与联系
- 词典
- 用jsp写一个动态表格
- 动态规划:从新手到专家(关于动态规划算法最精彩的中文描述,没有之一)
- 【计算机网络学习】之TCP和UDP比较
- UIApplication sharedApplication详细解释-IOS
- tyvj-1460 旅行
- 记住密码