Z分数计算器 - 标准分数和概率工具
Z分数计算器根据公式z=(x-平均值)÷标准差,计算某个数据点与平均值相差的标准差个数,即标准分数,并给出对应的累积概率,反映该数值在正态分布中所处的百分位位置。工具还可将不同量纲的数据标准化后比较,常用于考试成绩排名、异常值检测、质量控制和统计分析等场景,帮助快速判断数据的相对位置。
文档
什么是 Z 分数?
z 分数也称为标准分数,用于衡量数据点距离数据集均值有多少个标准差。z 分数为 0 表示该值等于均值。正 z 分数表示该值高于均值,负 z 分数表示该值低于均值。
Z 分数公式
数据点的 z 分数按以下公式计算:
其中:
- 是 z 分数
- 是数据点
- 是数据集的均值
- 是数据集的标准差
标准差不能为零,因为除以零没有定义结果。根据定义,标准差也不能为负数,因为它始终为零或正数。
如何计算 Z 分数
- 将所有数值相加,再除以数值个数 ,求出数据集的均值。
- 求标准差。首先计算方差,即各数值与均值之差的平方的平均值,然后求其平方根。
这是总体标准差,除以 。如果这些数值是从更大总体中抽取的样本,则改为除以 。
- 用数据点减去均值,再除以标准差。
计算示例
一名学生在一次测试中得分为 85。全班均值为 75,全班分数的标准差为 10。
- 数据点:
- 均值:
- 标准差:
该学生的 z 分数为 1.0。其分数高于全班平均分一个标准差。
Z 分数与累积概率
z 分数可以转换为累积概率,即从正态分布中随机选取的数值落在该点或该点以下的概率。这就是标准正态曲线在 左侧下方的面积。
对于该学生 1.0 的 z 分数,累积概率约为 0.8413,即 84.13%。这意味着,假设分数服从正态分布,该学生的得分大约高于全班 84% 的学生。计算器将 z 分数显示到小数点后四位,并将累积概率以百分比形式显示到小数点后两位。
以下是几个参考点:
| z 分数 | 累积概率 |
|---|---|
| -2.0 | 2.3% |
| -1.0 | 15.9% |
| 0.0 | 50.0% |
| 1.0 | 84.1% |
| 2.0 | 97.7% |
Z 分数的解读
正态分布中的大多数数值都位于均值的 2 个标准差以内。超过 +3 或 -3 的 z 分数很少见,通常被视为异常值,即与其余数据存在明显差异的数值。
z 分数还可以比较以不同尺度测量的数值。测试分数和身高测量值不能直接比较,但它们的 z 分数可以比较,因为二者都描述了数值以相同标准差单位表示的均值距离。
Z 分数与 T 分数
z 分数假设总体标准差已知,最适用于大样本。当总体标准差未知且样本较小时,则使用 t 分数,通常是少于 30 个观测值的样本。二者都描述了数值与均值的距离,但 t 分数来自 t 分布;该分布的尾部更厚,用于反映小样本带来的额外不确定性。
Z 分数的常见用途
- 标准化考试。 将学生的原始分数与总体分数分布进行比较。
- 异常值检测。 标记数据集中远离均值的数据点。
- 质量控制。 检查制造的产品是否处于可接受范围内。
- 假设检验。 z 检验使用 z 分数判断样本均值是否与已知总体均值存在有意义的差异。
历史
z 分数建立在正态分布的基础上。正态分布由 Abraham de Moivre 于 1733 年描述,并由 Carl Friedrich Gauss 和 Pierre-Simon Laplace 在 19 世纪初进一步发展。将数值标准化为标准差单位,在 20 世纪成为心理测验和质量控制中的常见做法。
常见问题
统计学中的 z 分数是什么? z 分数是数据点距离其数据集均值的标准差个数。其计算公式为 z = (x − μ) / σ。
如何解读 z 分数结果? z 分数为 0 表示该值等于均值。正值高于均值,负值低于均值。超过 +3 或 -3 的数值并不常见。
z 分数可以为负数吗? 可以。负 z 分数仅表示数据点低于均值。z 分数为 -2 表示该值低于均值 2 个标准差。
z 分数和 t 分数有什么区别? 当总体标准差已知时,z 分数用于大样本。总体标准差未知时,t 分数用于小样本,通常少于 30 个观测值。
z 分数的累积概率是什么意思? 它是从正态分布中随机选取的数值小于或等于给定 z 分数的概率。它等于正态曲线在该点左侧下方的面积。
如果标准差为零会怎样? z 分数没有定义,因为公式需要除以零。标准差为零意味着数据集中的每个数值都相同。