统计基础学习3--相关性
来源:互联网 发布:在这个网络社会上 编辑:程序博客网 时间:2024/06/05 00:16
平均数和变异性量数是用于描述数据分布特征的关键,但变量之间的关系如何描述?
或者说当一个变量发生变化的时候,另一个变量如何变化?
这就涉及到相关系数的计算。
相关系数(correlation coefficient):是反映两个事物(变量)之间线性关系的数值性指标。
相关关系的类型和相应的变量之间的关系
变量Y
相关关系的类型数值例子X值增大Y值增大直接的或正向的(0,1)存的钱越多,利息就越多X值降低Y值降低直接的或正向的(0,1)存的钱越少,利息就越少X值增大Y值降低间接的或负向的(-1,0)运动越多,体重就越轻X值降低Y值增大间接的或负向的(-1,0)运动越少,体重就越重
相关系数的绝对值越大,相关性越强,相关系数越接近于1或-1,相关度越强,相关系数越接近于0,相关度越弱。
通常情况下通过以下取值范围判断变量的相关强度:
皮尔逊相关(pearson product-momentcorrelation):也称为积差相关(或积矩相关)是英国统计学家皮尔逊于20世纪提出的一种计算直线相关的方法。
皮尔逊相关是一种线性相关系数,是用来反映两个变量线性相关程度的统计量。
n 是样本规模
X 是变量X的具体数值
Y 是变量Y的具体数值
XY 是每一个X值与相应的Y值的乘积
X2 是X值的平方
Y2 是Y值的平方
如计算下面这组数据
套公式为
n=10
(10×247-54×43) / ((10×320-542 )(10×201-432)) = 0.692
皮尔逊相关系数的适用范围
- 两个变量间有线性关系
- 变量是连续变量
- 变量均符合正态分布,且二元分布也符合正态分布
- 两变量独立
相关仅表示两个或更多变量之间存在关联关系,相关和因果关系无关。
- 统计基础学习3--相关性
- 相关性学习
- 文章内容相关性统计
- 相关性统计、排序
- 统计学习基础
- 相关性学习-皮尔逊相关系数
- 典型相关性学习
- 数据挖掘基础:相关性检验
- 白话空间统计十八:相关性分析
- 统计基础学习1--平均数
- 统计基础学习2--变异性
- 统计基础学习4--概率
- 相关性
- 相关性
- 相关性学习-皮尔逊相关系数2
- 统计自然语言处理基础学习笔记(3)——统计推理
- 网页搜索看样子相关性还是基础
- 统计基础学习5--显著性检验
- OCP培训笔记-External
- JAVA ASM字节码操纵框架
- 修改窗口类的类名
- C# WinForm开发系列 - DataGridView
- Perl 语言笔记(4) -- 输入输出
- 统计基础学习3--相关性
- JAVA学习之内存分析
- SRM536-div1-3-BinaryPolynomialDivOne
- MFC控件使用
- jQuery中each的用法
- Perl 语言笔记(5) -- 哈希
- JAVA 内部类的简单总结
- 函数指针 网址备注
- Perl学习笔记(6)-- 正则表达式