下载本文档
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、T检验和卡方检验好久没有更新博客了,今天更新一篇关于数据分析方法 的文章,主要是基于统计学的假设检验的原理,无论是 T检 验还是卡方检验在现实的工作中都可以被用到,而且结合 Excel非常容易上手,基于这类统计学上的显著性检验能够 让数据更有说服力。还是保持一贯的原则,先上方法论再上 应用实例,这篇文章主要介绍方法,之后会有另外一篇文章 来专门介绍实际的应用案例。关于假设检验假设检验(Hypothesis Testing),或者叫做显著性检验 (Significance Testing )是数理统计学中根据一定假设条件由样本推断总体的一种方法。其基本原理是先对总体的特征作 由莫种假设,然后通过
2、抽样研究的统计推理,对此假设应该 被拒绝还是接受作曲推断。既然以假设为前提,那么在进行 检验前需要提由相应的假设:H0:原假设或零假设(null hypothesis ),即需要去验证的假 设;一般首先认定原假设是正确的,然后根据显著性水平选 择是接受还是拒绝原假设。H1 :备择假设(alternative hypothesis), 一般是原假设的否 命题;当原假设被拒绝时,默认接受备择假设。如原假设是假设总体均值以=以0,则备择假设为总体均值以不以0,检验的过程就是计算相应的统计量和显著性概率, 来验证原假设应该被接受还是拒绝。T检验T检验(T Test)是最常见的一种假设检验类型,主要验证
3、总体均值间是否存在显著性差异。T检验属于参数假设检验,所以它适用的范围是数值型的数据,在网站分析中可以是访 问数、独立访客数、停留时间等,电子商务的订单数、销售 额等。T检验还需要符合一个条件一一总体符合正态分布。这里不介绍t统计量是怎么计算的,基于 t统计量的显著性 概率是怎么查询的,其实这些计算工具都可以帮我们完成, 如果有兴趣可以查阅统计类书籍,里面都会有相应的介绍。这里介绍的是用 Excel的数据分析工具来实现 T检验: Excel默认并没有加载“数据分析”工具,所以需要我们自 己添加加载项,通过文件一选项一加载项一勾选“分析工具 库”来完成添加,之后就可以在“数据”标签的最右方找到
4、数据分析这个按钮了,然后就可以开始做T检验了,这里以最常见的配对样本t检验为例,比较莫个电子商务网站在改 版前后订单数是否产生了显著性差异,以天为单位,抽样改 版前后各10天的数据进行比较:首先建立假设:H0:以1 =以2,改版前后每天订单数均值相等;H1 :以1 w以2,改版前后每天订单数均值不相等。将数据输入Excel,使用Excel的数据分析工具,选择“ t检 验:平均值的成对二样本分析”,输由检验结果:看到右侧显示的结果是不是有点晕了,看上去有点专业,其 实也并不难,只要关注一个数值的大小一一单尾的P值,这里是0.00565,如果需要验证在 95%的置信水平下的显著性, 那么0.005
5、65显然小于0.05 (1-95%),拒绝零假设,认为改 版前后的订单数存在显著性差异。简单说下为什么选择单尾 显著性概率P,而不是双尾,对于大部分网站分析的应用环 境,我们一般需要验证改动前后数值是否存在明显提升或下 实,所以一般而言只会存在一类可能一一或者提升或者下 降,所以只要检验单侧的概率即可,就像上面例子中改版后 的订单数均值1240.6大于改版前的1097.3,我们需要验证的 就是这种“大于”是否是显著的,也就是做的是左侧单边检 验,这种情况下只要关注单尾的显著性概率P即可。卡方检验卡方检验(chi-square test),也就是2检验,用来验证两个 总体问莫个比率之间是否存在显
6、著性差异。卡方检验属于非 参数假设检验,适用于布尔型或二项分布数据,基于两个概 率间的比较,早期用于生产企业的产品合格率等,在网站分 析中可以用于转化率、Bounce Rate等所有比率度量的比较分 析,其实在之前的文章 Abandonment Rate的影响因素进 行过相关的应用。这里同样不去介绍x2是如何计算得到的, 以及基于x2统计量的显著性概率的查询等,这里直接以转 化率为例来比较网站改版前后转化率是否发生了显著性差异,抽样改版前后各 3天的网站分析数据一一总访问数和转 化的访问数,用“转化访问数 /总访问数”计算得到转化率:首先建立假设:H0: r1=r2,改版前后转化率相等;H1:
7、 r1r2,改版前后转化率不相等。其实这是一个最简单的四格卡方检验的例子,也无需使用SPSS (当然你足够熟悉 SPSS也可以使用类似的统计分析工 具),为了简化中间的计算步骤,我这里用Excel直接制作了一个简单的卡方检验的模板,只要在相应的单元格输入统计 数据就能自动显示检验的结果:点击下载:卡方检验示例Excel中浅蓝色的单元格都支持输入,包括原用方案和测试 方案的总访问数和转化访问数,另外置信度95%也是支持修改了,如果你需要 99%的置信水平,只要修改这个单元格即 可。怎么看检验结果?其实非常简单,只要看那个红色的“存在” 单元格的显示结果即可, 上面的案例中两者的转化率 “存在” 显著性差异,如果不存在,则该单元格相应的就会显示“不 存在”,有了这个模板对于 A/B Testing等类似的数据比较也 显得非常简单容易,或者说其实这个Excel模板就是为了 A/B Testing而量
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 滨州学院《英国文学史及作品选读》2023-2024学年第一学期期末试卷
- 毕节工业职业技术学院《机械制造装备设计课程设计》2023-2024学年第一学期期末试卷
- 二零二五年度2025版个人承包教育培训资源共享合同范本3篇
- 企业法人委托代理合同
- 2025版食品工厂灌装设备研发合作合同样本3篇
- 二手车交易合同个人简版
- 解除合同联系函
- 邮政业务外包合同
- 大学会计实习报告范文6篇
- 2024年香精炉灯项目可行性研究报告
- 规范集团中层管理人员退休返聘的若干规定
- 无机及分析化学考试题(附答案)
- “小学数学分层教学研究与实践”课题成果报告
- 航海仪器页课件
- 刘禹锡《陋室铭》课件(17张)
- 2022-2023学年龙泉驿区三年级数学第一学期期末综合测试试题含解析
- 膝关节病护理查房ppt
- 西交《电子商务技术》在线作业答卷
- 2022年工程项目经理任命书
- 《中国古代文学史——李白》优秀PPT课件
- 履带吊验收表
评论
0/150
提交评论