首页 > 经验 > 关键词  > T检验最新资讯  > 正文

T检验和卡方检验

2011-07-28 09:10 · 稿源:网站数据分析

好久没有更新博客了,今天更新一篇关于数据分析方法的文章,主要是基于统计学的假设检验的原理,无论是T检验还是卡方检验在现实的工作中都可以被用到,而且结合Excel非常容易上手,基于这类统计学上的显著性检验能够让数据更有说服力。还是保持一贯的原则,先上方法论再上应用实例,这篇文章主要介绍方法,之后会有另外一篇文章来专门介绍实际的应用案例。

关于假设检验

假设检验(Hypothesis Testing),或者叫做显著性检验(Significance Testing)是数理统计学中根据一定假设条件由样本推断总体的一种方法。其基本原理是先对总体的特征作出某种假设,然后通过抽样研究的统计推理,对此假设应该被拒绝还是接受作出推断。既然以假设为前提,那么在进行检验前需要提出相应的假设:

H0:原假设或零假设(null hypothesis),即需要去验证的假设;一般首先认定原假设是正确的,然后根据显著性水平选择是接受还是拒绝原假设。

H1:备择假设(alternative hypothesis),一般是原假设的否命题;当原假设被拒绝时,默认接受备择假设。

如原假设是假设总体均值μ=μ0,则备择假设为总体均值μ≠μ0,检验的过程就是计算相应的统计量和显著性概率,来验证原假设应该被接受还是拒绝。

T检验

T检验(T Test)是最常见的一种假设检验类型,主要验证总体均值间是否存在显著性差异。T检验属于参数假设检验,所以它适用的范围是数值型的数据,在网站分析中可以是访问数、独立访客数、停留时间等,电子商务的订单数、销售额等。T检验还需要符合一个条件——总体符合正态分布。

这里不介绍t统计量是怎么计算的,基于t统计量的显著性概率是怎么查询的,其实这些计算工具都可以帮我们完成,如果有兴趣可以查阅统计类书籍,里面都会有相应的介绍。这里介绍的是用Excel的数据分析工具来实现T检验:

Excel默认并没有加载“数据分析”工具,所以需要我们自己添加加载项,通过文件—选项—加载项—勾选“分析工具库”来完成添加,之后就可以在“数据”标签的最右方找到数据分析这个按钮了,然后就可以开始做T检验了,这里以最常见的配对样本t检验为例,比较某个电子商务网站在改版前后订单数是否产生了显著性差异,以天为单位,抽样改版前后各10天的数据进行比较:

首先建立假设:

H0:μ1=μ2,改版前后每天订单数均值相等;

H1:μ1≠μ2,改版前后每天订单数均值不相等。

将数据输入Excel,使用Excel的数据分析工具,选择“t检验:平均值的成对二样本分析”,输出检验结果:

看到右侧显示的结果是不是有点晕了,看上去有点专业,其实也并不难,只要关注一个数值的大小——单尾的P值,这里是0.00565,如果需要验证在95%的置信水平下的显著性,那么0.00565显然小于0.05(1-95%),拒绝零假设,认为改版前后的订单数存在显著性差异。简单说下为什么选择单尾显著性概率P,而不是双尾,对于大部分网站分析的应用环境,我们一般需要验证改动前后数值是否存在明显提升或下降,所以一般而言只会存在一类可能——或者提升或者下降,所以只要检验单侧的概率即可,就像上面例子中改版后的订单数均值1240.6大于改版前的1097.3,我们需要验证的就是这种“大于”是否是显著的,也就是做的是左侧单边检验,这种情况下只要关注单尾的显著性概率P即可。

卡方检验

卡方检验(chi-square test),也就是χ2检验,用来验证两个总体间某个比率之间是否存在显著性差异。卡方检验属于非参数假设检验,适用于布尔型或二项分布数据,基于两个概率间的比较,早期用于生产企业的产品合格率等,在网站分析中可以用于转化率、Bounce Rate等所有比率度量的比较分析,其实在之前的文章——Abandonment Rate的影响因素进行过相关的应用。这里同样不去介绍χ2是如何计算得到的,以及基于χ2统计量的显著性概率的查询等,这里直接以转化率为例来比较网站改版前后转化率是否发生了显著性差异,抽样改版前后各3天的网站分析数据——总访问数和转化的访问数,用“转化访问数/总访问数”计算得到转化率:

首先建立假设:

H0:r1=r2,改版前后转化率相等;

H1:r1≠r2,改版前后转化率不相等。

其实这是一个最简单的四格卡方检验的例子,也无需使用SPSS(当然你足够熟悉SPSS也可以使用类似的统计分析工具),为了简化中间的计算步骤,我这里用Excel直接制作了一个简单的卡方检验的模板,只要在相应的单元格输入统计数据就能自动显示检验的结果:

点击下载:卡方检验示例

Excel中浅蓝色的单元格都支持输入,包括原用方案和测试方案的总访问数和转化访问数,另外置信度95%也是支持修改了,如果你需要99%的置信水平,只要修改这个单元格即可。

怎么看检验结果?其实非常简单,只要看那个红色的“存在”单元格的显示结果即可,上面的案例中两者的转化率“存在”显著性差异,如果不存在,则该单元格相应的就会显示“不存在”,有了这个模板对于A/B Testing等类似的数据比较也显得非常简单容易,或者说其实这个Excel模板就是为了A/B Testing而量身定制的。

好了,就到这里吧,其实这篇文章并不是想从专业的统计学的角度来介绍T检验和卡方检验,只是想让大家了解这两个方法的原理和适用条件,能够用最简单的方式去使用诸如此类的方法让数据更具说服力,请继续关注之后奉上的应用实例。

文章来源:网站数据分析 转载请注明出处链接。

  • 相关推荐
  • 大家在看
  • 腾讯云服务器12.12限时秒杀-1核2G首年50元

    腾讯云服务器12.12多种机型限时抢购,1核2G服务器4.17元/月,2核4G服务器6.17元/月,专业技术7*24小时在线服务,腾讯云为企业和个人提供快捷,安全,稳定的云服务!

    广告
  • 字节跳动于上海投资成立医学检验

    上海微荷医学检验所有限公司成立,法定代表人为吴海锋,注册资本 100 万元人民币,经营范围包含:检验检测服务;医疗服务;医学研究和试验发展等。

  • 天猫调整食品品质抽检检验要求 增加零食等多项类目

    今日,天猫发布通知称,为提升天猫商品质量水平,进一步保障消费者和商家的合法权益,将对《天猫食品品质抽检检验要求》进行调整...据悉,本次调整对传统滋补营养品、保健食品/膳食营养补充食品、零食/坚果/特产、粮油调味/速食/干货/烘焙、咖啡/麦片/冲饮、茶、奶粉/辅食/营养品/零食、水产肉类/新鲜蔬果/熟食类目净含量提出了检测要求...规定明确指出,按照抽检规则要求检测单件样品净含量,样品标示净含量及页面描述净含量与实?

  • 喜讯 美的空调荣获中国检验检测学会全国首家科技创新实验室

    12 月 16 日,美的集团“家用空调绿色低碳换热技术创新实验室”正式授牌,成为全国首家获得中国检验检测学会科技创新实验室的企业。深入交流合作,共谋高质量发展本次授牌仪式,美的集团家用空调事业部总裁赵磊、中国检验检测学会常务副会长生飞、中国家用电器研究院院长刘挺、中国电器科学研究院副院长陈伟升、中国检验检测学会秘书长宫赤霄、美的家用空调品质管理总监晏飞、创新研究院主任李金波等出席。美的空调获得全国首家科?

  • TikTok究竟还有什么不能「卖」?

    今年,TikTok真可谓无处不在。根据追踪互联网流量的云基础设施公司Cloudflare Inc.的数据,这个依靠算法推荐而闻名的短视频平台成为了2021年世界上访问量最大的互联网网站,超过了霸榜多年的搜索引擎Google。

  • 日本研究团队打造可“舔屏”的TTTV风味电视

    由日本教授发明的这款奇妙产品,特点是配备了 10 个“调味罐”...本东京明治大学宫下研究室 Homei Miyashita 教授表示,在花了一年多的时间来制作之后,其正在与大约 30 名学生组成的团队合作,以期通过各种小工具的来改进 TTTV,比如有助于改善食物风味的叉子...目前 TTTV 仍处于原型阶段,但其已通过验证测试,表明它可以正常工作...但为了实现可“舔屏”的效果,研究团队最终决定将风味样品喷洒在出于卫生考虑的屏幕薄膜上...

  • TST庭秘密究竟有什么“秘密”?

    以“选择美丽,天生美丽”为品牌理念的TST庭秘密,是一个非常有爱、有温度的品牌。从 2013 年诞生以来,一直以分享美丽,传递健康为目标,并坚持多元化的发展战略,积极拓展经营范围,如今产业已涵盖美妆护肤、大健康产业、红酒、家居用品、服装等不同领域,是围绕家庭生活消费市场的新兴品牌代表。 TST从成立之初,就坚持稳健的经营模式,诚实守信、重视品质,并拥有独立科研团队和科研基地,旗下多种产品添加成分还获得了国家专

  • RTX 3070 Ti/3080 Ti笔记本显卡发布:性能超桌面TITAN RTX

    CES 2022开场活动可谓百花齐放,IAN三家轮番登场,NVIDIA这边除了桌面RTX 3050/3090 Ti显卡,笔记本端的RTX 3080 Ti/3070 Ti显卡也一同公布。NV称RTX 3090 Ti将助力打造史上最快的游戏本,性能比桌面TITAN RTX还要强。主要两点包括16GB GDDR6显存、1440P下120FPS+游戏帧率、相关笔记本起售价2499美元,2月1日发售。基本规格方面,RTX 3080 Ti笔记本显卡集成7424个CUDA(据说首发GA103核心)、频率1125~1590MHz,256bit位宽、可定义

  • 基准测试显示RTX 3070 Ti笔记本GPU中可提供Titan RTX级别的性能

    NVIDIA最近发布的GeForce RTX 3070Ti笔记本GPU的最新基准测试已经泄露出来,并显示了令人印象深刻的性能数据:它与Titan RTX桌面显卡有着类似的性能。在Geekbench 5OpenCL基准测试中发现了最新的条目,其中笔记本GPU出现在一台微星Vector GP66(12UGS)笔记本上。这是微星在2022年CES上推出的最新12代笔记本电脑之一,拥有令人印象深刻的规格,如英特尔酷睿i7-12700H 14核CPU,以及NVIDIA GeForce RTX 3070 Ti笔记本GPU。NVIDIA GeForce RTX 3070 Ti将采用GA104 GPU,其整体性能比GeForce RTX 2070 SUPER快70%,该图形芯片将出现在起价149

  • 在法国败诉后 Twitter将被迫分享有关仇恨言论控制的细节

    新裁决实际上验证了去年下级法院的一项裁决,在该裁决中,Twitter被命令提供其雇用的人力资源的细节,以处理该社交媒体平台法国版上的这一问题...该法院还命令 Twitter披露任何有助于确定其利用财政和人力资源在该国打击网络仇恨言论的文件...巴黎上诉法院的最新裁决对Twitter来说是一个重大打击,因为它也是该公司在欧洲可能面临的类似案件的一个先例,也是未来出现的任何类似性质的诉讼...除了下令披露其仇恨言论控制、人力和文件的细节外,上诉法院还要求Twitter向六名原告每人支付1500欧元的赔偿......

  • 特朗普与Twitter、脸书“分手”一年了 他们过得都还不错

    Twitter、脸书继续向特朗普卖广告...在这些平台上,特朗普积累了大约1.5亿粉丝...尽管这些公司已经封杀了特朗普,但他们仍继续向特朗普以及他的对手和盟友出售广告,这些对手和盟友把特朗普作为自己政治广告的关键部分...特朗普享受离开Twitter的日子...根据FiveThirtyEight.com提供的全国民调平均数据,在国会大厦暴力骚乱发生一年后,大约52%的美国人表示不支持特朗普,而43%的人表示,支持率较不支持率低了9个百分点...“没有Twitter更好,因为我不用转发人们不喜欢的愚蠢推文——转发才是让你着迷的,”特朗普在3月为新书《坦白地说,我们确实赢得了这场选举:特朗普如何输掉的内幕故事》接受采访时称,“我还节省了很多时间...

这篇文章对你有价值吗?

  • 热门标签

热文

  • 3 天
  • 7天