跳至内容

T检验计算器 - 免费在线统计分析工具

免费的在线T检验统计计算器。输入一组或两组实验样本数据,即可立即得到T统计量、自由度和对应的P值计算结果,同时支持单样本T检验、独立双样本T检验、配对样本T检验和Welch T检验这几种最常见的类型,适用于大学统计学课程作业练习、科研实验数据分析和假设检验中的显著性判断依据。

输入样本的逗号分隔数值

加载计算器...
📚

文档

什么是 t 检验?

t 检验是一种统计方法,用于检验一组数字的平均值是否与另一个平均值或某个固定值存在有意义的差异。它也称为学生 t 检验。研究人员使用它比较两个组,例如处理组和对照组,或将一个组与已知标准进行比较。

该检验会产生一个称为 t 统计量的数值。远离零的 t 统计量表明平均值确实存在差异。接近零的 t 统计量表明这种差异可能只是随机噪声造成的。

t 检验的类型

此计算器支持三种 t 检验。

  • 单样本 t 检验:将一个样本的均值与已知值或假设值进行比较。
  • 双样本 t 检验:比较两个独立样本的均值,例如两个相互独立的人群组。此计算器使用 Welch t 检验,该检验不假设两个组的离散程度相同。
  • 配对 t 检验:比较从同一组受试者获得的两组测量值,例如处理前后的得分。

如何使用此 t 检验计算器

  1. 选择检验类型:单样本、双样本或配对。
  2. 输入数据。
    • 单样本:输入样本值,以逗号分隔,并输入用于比较的总体均值。
    • 双样本:分别输入两个样本,每个样本中的数值以逗号分隔。
    • 配对:以 (x1,y1)、(x2,y2) 等形式输入各对数值。
  3. 设置显著性水平,通常为 0.05。计算器不使用此数值,而是报告 p 值,将判断留给用户。
  4. 数据足够时,t 统计量、自由度和 p 值会立即显示。无需按任何按钮。

要判断显著性,请将 p 值与显著性水平进行比较。如果 p 值小于或等于显著性水平,则认为差异具有统计学显著性。

t 检验公式

单样本 t 检验公式

t=xˉ−μ0s/nt = \frac{\bar{x} - \mu_0}{s / \sqrt{n}}

xˉ\bar{x} 是样本均值,μ0\mu_0 是用于比较的值,ss 是样本标准差,nn 是样本量。自由度:df=n−1df = n - 1。

双样本 t 检验公式(Welch 检验)

t=xˉ1−xˉ2s12n1+s22n2t = \frac{\bar{x}_1 - \bar{x}_2}{\sqrt{\dfrac{s_1^2}{n_1} + \dfrac{s_2^2}{n_2}}}

自由度由 Welch–Satterthwaite 方程得出:

df=(s12n1+s22n2)2(s12/n1)2n1−1+(s22/n2)2n2−1df = \frac{\left(\dfrac{s_1^2}{n_1} + \dfrac{s_2^2}{n_2}\right)^2}{\dfrac{(s_1^2/n_1)^2}{n_1 - 1} + \dfrac{(s_2^2/n_2)^2}{n_2 - 1}}

此公式通常会得出一个不是整数的 df。

配对 t 检验公式

t=dˉsd/nt = \frac{\bar{d}}{s_d / \sqrt{n}}

dˉ\bar{d} 是每对数值之差的均值,sds_d 是这些差值的标准差,nn 是配对数。自由度:df=n−1df = n - 1。

如何计算 t 检验:计算示例

一家制造商声称,电池的平均续航时间为 50 小时。测试人员检测了九块电池,并记录了以下续航时间,单位为小时:

51、49、52、48、50、47、53、49、51

步骤 1:陈述假设。 原假设:真实均值为 50 小时。备择假设:真实均值不是 50 小时。

步骤 2:求样本均值。

xˉ=51+49+52+48+50+47+53+49+519=50.00\bar{x} = \frac{51+49+52+48+50+47+53+49+51}{9} = 50.00

步骤 3:求样本标准差。 各数据与均值的偏差为 1、-1、2、-2、0、-3、3、-1、1。平方后分别为 1、1、4、4、0、9、9、1、1,总和为 30。

s=309−1=3.75≈1.94s = \sqrt{\frac{30}{9-1}} = \sqrt{3.75} \approx 1.94

步骤 4:求 t 统计量。

t=50.00−501.94/9=0.00t = \frac{50.00 - 50}{1.94 / \sqrt{9}} = 0.00

步骤 5:求自由度。

df=9−1=8df = 9 - 1 = 8

步骤 6:求 p 值。 当 t=0t = 0 且 df=8df = 8 时,双侧 p 值为 1.00。

步骤 7:得出结论。 由于 1.00 大于 0.05,没有足够证据表明电池的平均续航时间不同于 50 小时。

t 检验的假设条件

只有在几个条件大致成立时,t 检验才能给出可靠结果。

  • 正态性:数据应大致呈钟形分布,尤其是在小样本中。
  • 独立性:每个观测值不应影响其他任何观测值。
  • 随机抽样:数据应来自所研究总体的随机样本。

对于配对 t 检验,这些条件适用于每对数值之间的差值,而不是原始得分。对于较大的样本,通常是大于 30 时,即使数据并非完美的钟形分布,t 检验通常仍能保持准确,这是因为一种称为中心极限定理的统计性质。

t 检验的替代方法

当上述假设条件不成立时,可以改用其他检验。

  • Mann-Whitney U 检验:双样本 t 检验的非参数替代方法。
  • Wilcoxon 符号秩检验:配对 t 检验的非参数替代方法。
  • 方差分析(ANOVA):一次比较三个或更多组的均值,而不只是比较两组。

t 检验的历史

William Sealy Gosset 于 1908 年在都柏林的 Guinness 啤酒厂担任化学家期间开发了 t 检验。Guinness 不允许员工以自己的姓名发表研究,因此 Gosset 使用了笔名“Student”。这就是该方法通常被称为学生 t 检验的原因。他创建这种方法,是为了判断小批量酿造原料是否符合质量标准,每次只使用少量样本。

常见问题

t 检验用于什么?

t 检验用于检验样本均值是否与另一个平均值或某个固定值存在显著差异。它常用于医学、心理学、教育学和商业研究。

什么时候应使用单样本、双样本或配对 t 检验?

使用单样本 t 检验将样本均值与已知值进行比较。使用双样本 t 检验比较两个相互独立且无关联的组。当对同一组受试者进行两次测量时,应使用配对 t 检验,例如比较处理前后的测量结果。

t 检验与 z 检验有什么区别?

当样本较小或总体标准差未知时,使用 t 检验。当样本较大且总体标准差已知时,使用 z 检验。实际上,t 检验的使用频率高得多,因为总体标准差很少能预先知道。

如何解释 t 检验的 p 值?

p 值表示:如果实际上不存在真正的差异,观察到如此大或更大差异的概率。较小的 p 值(通常小于或等于 0.05)表明观察到的差异不太可能仅由偶然因素造成。

什么是 Welch t 检验?

Welch t 检验是双样本 t 检验的一种形式,不要求两个组具有相等的方差。此计算器在双样本检验中始终使用 Welch 方法,因为无论两个组的离散程度是否相同,该方法都能保持准确。

t 检验中的自由度是什么?

自由度是一个根据样本量确定的数值,用于确定计算 p 值时所使用的 t 分布的确切形状。对于单样本或配对 t 检验,自由度等于样本量减去 1。Welch 双样本 t 检验使用的公式通常会产生一个不是整数的值。

参考文献

  1. Gosset, W. S. (1908). 《均值的可能误差》。Biometrika,6(1),1–25。
  2. NIST/SEMATECH《统计方法电子手册》,第 1.3.6.7.2 节,《学生 t 分布的临界值》。