多异常值判定:狄克逊准则临界值表及 Excel 公式模
板
适用场景:填料塔持液量重复实验数据中多个异常值的识别与剔除(弥补格拉布斯准则仅适用于单异常值
的不足)置信度:95%(工程实验标准置信水平)
适配数据量:n=3∼30 次重复实验
一、 狄克逊准则核心原理
将 n 个实验数据按从小到大排序:x1≤x2≤∼≤xn
根据数据量 n 选择对应的统计量计算公式(区分单侧 / 双侧检验)
计算统计量 D,与临界值 ,n 对比:
若 D>,n → 判定为异常值,剔除后重复计算,直至无异常值
优势:可逐次识别并剔除多个离群数据,适合重复性实验的精准数据筛选
二、 狄克逊准则临界值表(置信度 95%)
重
复实
验次
数 n
统计量公式(双侧检验)
临
界值
,n
重
复实
验次
数 n
统计量公式(双侧检验)
临
界值
,n
3 D=max(x3−x1x2−x1,x3−x1x3−x2)
70
1
7
D=max(x16−x1x3−x1,x17−x2x17
−x15)
41
4 D=max(x4−x1x2−x1,x4−x1x4−x3)
29
1
8
D=max(x17−x1x3−x1,x18−x2x18
−x16)
25
5 D=max(x5−x1x2−x1,x5−x1x5−x4)
10
1
9
D=max(x18−x1x3−x1,x19−x2x19
−x17)
12
6 D=max(x6−x1x2−x1,x6−x1x6−x5)
28
2
0
D=max(x19−x1x3−x1,x20−x2x20
−x18)
00
7 D=max(x7−x1x2−x1,x7−x1x7−x6)
69
2
1
D=max(x20−x1x3−x1,x21−x2x21
−x19)
90
8 D=max(x7−x1x2−x1,x8−x2x8−x7)
30
2
2
D=max(x21−x1x3−x1,x22−x2x22
−x20)
81
9 D=max(x8−x1x2−x1,x9−x2x9−x8)
02
2
3
D=max(x22−x1x3−x1,x23−x2x23
−x21)
73
1
0
D=max(x9−x1x2−x1,x10−x2x10−x9)
79
2
4
D=max(x23−x1x3−x1,x24−x2x24
−x22)
65
1
1
D=max(x10−x1x2−x1,x11−x2x11
−x10)
58
2
5
D=max(x24−x1x3−x1,x25−x2x25
−x23)
59
1
2
D=max(x11−x1x3−x1,x12−x2x12
−x11)
41
2
6
D=max(x25−x1x3−x1,x26−x2x26
−x24)
52
1
3
D=max(x12−x1x3−x1,x13−x2x13
−x12)
25
2
7
D=max(x26−x1x3−x1,x27−x2x27
−x25)
47
重
复实
验次
数 n
统计量公式(双侧检验)
临
界值
,n
重
复实
验次
数 n
统计量公式(双侧检验)
临
界值
,n
1
4
D=max(x13−x1x3−x1,x14−x2x14
−x13)
11
2
8
D=max(x27−x1x3−x1,x28−x2x28
−x26)
41
1
5
D=max(x14−x1x3−x1,x15−x2x15
−x14)
99
2
9
D=max(x28−x1x3−x1,x29−x2x29
−x27)
37
1
6
D=max(x15−x1x3−x1,x16−x2x16
−x15)
88
3
0
D=max(x29−x1x3−x1,x30−x2x30
−x28)
32
三、 Excel 自动剔除公式(以 5 次重复实验为例)
表格结构(嵌入原始数据录入表)
工况
编号
重复
1
重复
2
重复
3
重复
4
重复
5
排序后最
小值
排序后最
大值
剔除异常
值后平均值
1# 公式嵌入
核心公式(分步实现,避免数组公式复杂操作)
步骤 1:对 5 个数据排序(提取最值)
最小值(单元格 G2):=MIN(B2:F2)
最大值(单元格 H2):=MAX(B2:F2)
第二小值(单元格 I2):=SMALL(B2:F2,2)
第四大值(单元格 J2):=LARGE(B2:F2,2)
步骤 2:计算狄克逊统计量 D(单元格 K2)
=MAX((I2−G2)/(H2−G2),(H2−J2)/(H2−G2))
步骤 3:判断并剔除异常值(单元格 L2)
excel
=IF(K2>,
AVERAGE(IF((B2:F2<>G2)*(B2:F2<>H2),B2:F2,"")),
AVERAGE(B2:F2))
公式说明:
临界值 对应 n=5 的 ,5;
若统计量 D 大于临界值,剔除最小值和最大值,计算剩余 3 个数据的平均值;
若不存在异常值,直接计算 5 个数据的平均值。
多轮剔除说明
若剔除 1 组异常值后,剩余数据仍存在离群值,需重复上述步骤:
以剩余数据为新的数据集;
重新计算统计量 D 和对比临界值;
直至统计量 D 小于临界值,停止剔除。
四、 使用注意事项
统计量公式匹配:不同 n 对应不同的统计量计算公式,需严格对照临界值表选择,避免公式错误;
适用数据量:n<3 时无法判定异常值,n>30 建议采用正态分布近似法;
与格拉布斯准则对比:单异常值场景用格拉布斯准则更简便,多异常值场景优先用狄克逊准则;
公式拓展:如需适配 n=10 等其他数据量,只需替换统计量公式和临界值即可。