如果您无法下载资料,请参考说明:
1、部分资料下载需要金币,请确保您的账户上有足够的金币
2、已购买过的文档,再次下载不重复扣费
3、资料包下载后请先用软件解压,在使用对应软件打开
是表中最基本的数据,因此上表资料又被称之为四格表资料。卡方检验的统计量是卡方值,它是每个格子实际频数A与理论频数T差值平方与理论频数之比的累计和。每个格子中的理论频数T是在假定两组的发癌率相等(均等于两组合计的发癌率)的情况下计算出来的,如第一行第一列的理论频数为71*91/113=57.18,故卡方值越大,说明实际频数与理论频数的差别越明显,两组发癌率不同的可能性越大。二、四格表资料的卡方检验四格表资料的卡方检验用于进行两个率或两个构成比的比较。1.专用公式:若四格表资料四个格子的频数分别为a,b,c,d,则四格表资料卡方检验的卡方值=(ad-bc)…^2*n/(a+b)(c+d)(a+c)(b+d),自由度v=(行数-1)(列数-1)2.应用条件:要求样本含量应大于40且每个格子中的理论频数不应小于5。当样本含量大于40但理论频数有小于5的情况时卡方值需要校正,当样本含量小于40时只能用确切概率法计算概率。三、行X列表资料的卡方检验行X列表资料的卡方检验用于多个率或多个构成比的比较。1.专用公式:r行c列表资料卡方检验的卡方值=n[(A11/n1n1+A12/n1n2+...+Arc/nrnc)-1]2.应用条件:要求每个格子中的理论频数T均大于5或1<T<5的格子数不超过总格子数的1/5。当有T<1或1<T<5的格子较多时,可采用并行并列、删行删列、增大样本含量的办法使其符合行X列表资料卡方检验的应用条件。而多个率的两两比较可采用行X列表分割的办法。四、列联表资料的卡方检验:同一组对象,观察每一个个体对两种分类方法的表现,结果构成双向交叉排列的统计表就是列联表。1.R*C列联表的卡方检验:R*C列联表的卡方检验用于R*C列联表的相关分析,卡方值的计算和检验过程与行X列表资料的卡方检验相同。2.2*2列联表的卡方检验:2*2列联表的卡方检验又称配对记数资料或配对四格表资料的卡方检验,根据卡方值计算公式的不同,可以达到不同的目的。当用一般四格表的卡方检验计算时,卡方值=(ad-bc)2n/(a+b)(c+d)(a+c)(b+d),此时用于进行配对四格表的相关分析,如考察两种检验方法的结果有无关系;当卡方值=(|b-c|-1)2/(b+c)时,此时卡方检验用来进行四格表的差异检验,如考察两种检验方法的检出率有无差别。列联表卡方检验应用中的注意事项同R*C表的卡方检验相同。第十四课:回归分析与相关分析(2009-08-2921:01:56)转载▼标签:回归方程离均差相关系数相关分析平方和杂谈分类:01.统计基础一、直线回归分析直线回归是用直线回归方程表示两个数量变量间依存关系的统计分析方法,属双变量分析的范畴。1.直线回归方程的求法(1)回归方程的概念:直线回归方程的一般形式是Ý(音yhat)=a+bx,其中x为自变量,一般为资料中能精确测定和控制的量,Y为应变量,指在x规定范围内随机变化的量。a为截距,是回归直线与纵轴的交点,b为斜率,意为x每改变一个单位时,Ý的变化量。(2)直线回归方程的求法确定直线回归方程利用的是最小二乘法原理,基本步骤为:1)先求b,基本公式为b=lxy/lxx=SSxy/SSxx,其中lxy为X,Y的离均差积和,lxx为X的离均差平方和;2)再求a,根据回归方程a等于Y的均值减去x均值与b乘积的差值。(3)回归方程的图示:根据回归方程,在坐标轴上任意取相距较远的两点,连接上述两点就可得到回归方程的图示。应注意的是,连出的回归直线不应超过x的实测值范围.2.回归关系的检验回归关系的检验又称回归方程的检验,其目的是检验求得的回归方程在总体中是否成立,即是否样本代表的总体也有直线回归关系。方法有以下两种:(1)方差分析其基本思想是将总变异分解为SS回归和SS剩余,然后利用F检验来判断回归方程是否成立。(2)t检验其基本思想是利用样本回归系数b与总体均数回归系数ß进行比较来判断回归方程是否成立,实际应用中因为回归系数b的检验过程较为复杂,而相关系数r的检验过程简单并与之等价,故一般用相关系数r的检验来代替回归系数b的检验。3.直线回归方程的应用(1)描述两变量之间的依存关系;利用直线回归方程即可定量描述两个变量间依存的数量关系(2)利用回归方程进行预测;把预报因子(即自变量x)代入回归方程对预报量(即因变量Y)进行估计,即可得到个体Y值的容许区间。(3)利用回归方程进行统计控制规定Y值的变化,通过控制x的范围来实现统计控制的目标。如已经得到了空气中NO2的浓度和汽车流量间的回归方程,即可通过控制汽车流量来控制空气中NO2的浓度。4.应用直线回归的注意事项(1)做回归分析要有实际意义;(2)