Skip to article frontmatterSkip to article content
Site not loading correctly?

This may be due to an incorrect BASE_URL configuration. See the MyST Documentation for reference.

6.8 在 2^{k} 设计中加入中心点

使用两水平因子设计时,一个潜在的顾虑是因子效应的线性假定。当然,完全线性并非必要,即使线性假定只是很粗略地成立,2k2^{k} 体系也工作得相当好。事实上我们已经指出,如果在一阶或主效应模型中加入交互作用项,得到

y=β0+∑j=1kβjxj+∑∑i<jβijxixj+ϵ(6.28)y = \beta_{0} + \sum_{j = 1}^{k} \beta_{j} x_{j} + \sum \sum_{i < j} \beta_{i j} x_{i} x_{j} + \epsilon \tag{6.28}

那么我们就有能力表示响应函数中某种弯曲的模型。这种弯曲当然来自交互作用项 βijxixj\beta_{ij}x_{i}x_{j} 所导致的平面扭曲。

在某些情形中,响应函数中的弯曲不能由式 6.28 充分建模。此时一个合乎逻辑的模型是

y=β0+∑j=1kβjxj+∑∑i<jβijxixj+∑j=1kβijxj2+ϵ(6.29)y = \beta_{0} + \sum_{j = 1}^{k} \beta_{j} x_{j} + \sum \sum_{i < j} \beta_{i j} x_{i} x_{j} + \sum_{j = 1}^{k} \beta_{i j} x_{j}^{2} + \epsilon \tag{6.29}

其中 βjj\beta_{jj} 表示纯二阶效应或二次效应。式 6.29 称为二阶响应曲面模型。

在进行两水平因子试验时,我们通常预期拟合式 6.28 的一阶模型,但也应当警惕式 6.29 的二阶模型更合适的可能性。有一种在 2k2^{k} 因子试验中重复某些点的方法,既能对二阶效应引起的弯曲提供防护,又能得到独立的误差估计。这种方法就是在 2k2^{k} 设计中加入中心点(center points),即在点 xi=0 (i=1,2,…,k)x_{i}=0\ (i=1,2,\ldots,k) 处做 nCn_{C} 次重复。在设计中心处加入重复试验的一个重要理由是,中心点不影响 2k2^{k} 设计中通常的效应估计。加入中心点时,我们假定 kk 个因子都是定量的。

为说明这一方法,考虑一个 22 设计,在每个因子点 (−,−)(-,-)、(+,−)(+,-)、(−,+)(-,+) 和 (+,+)(+,+) 处各有一个观测,在中心点 (0,0)(0,0) 处有 nCn_{C} 个观测。图 6.37 和图 6.38 说明了这一情形。

图 6.37 带中心点的 22 设计

图 6.38 带中心点的 22 设计

设 y‾F\overline{y}_{F} 是四个因子点处四次试验的平均,y‾C\overline{y}_{C} 是中心点处 nCn_{C} 次试验的平均。如果差 y‾F−y‾C\overline{y}_{F}-\overline{y}_{C} 很小,那么中心点就落在(或接近落在)通过各因子点的平面上,不存在二次弯曲。反之,如果 y‾F−y‾C\overline{y}_{F}-\overline{y}_{C} 很大,那么就存在二次弯曲。纯二次弯曲的单自由度平方和由下式给出:

SSPure quadratic=nFnC(y‾F−y‾C)2nF+nC(6.30)SS_{\text{Pure quadratic}} = \frac{n_{F} n_{C} (\overline{{y}}_{F} - \overline{{y}}_{C})^{2}}{n_{F} + n_{C}} \tag{6.30}

其中一般地 nFn_{F} 是因子设计点的个数。这个平方和可以纳入方差分析,并与误差均方比较以检验纯二次弯曲。更具体地说,当在 2k2^{k} 设计的中心加入点时,用式 6.30 所作的弯曲检验实际上是检验假设

H0:∑j=1kβjj=0H_{0}: \sum_{j = 1}^{k} \beta_{j j} = 0
H1:∑j=1kβjj≠0H_{1}: \sum_{j = 1}^{k} \beta_{j j} \neq 0

此外,如果设计中的因子点没有重复,还可以用 nCn_{C} 个中心点构造一个具有 nC−1n_{C}-1 个自由度的误差估计。也可以用 tt 检验来检验弯曲。参见本章的补充材料。

例 6.7

我们通过重新考虑例 6.2 中的中间试验工厂试验来说明在 2k2^{k} 设计中加入中心点。回顾该试验是一个无重复的 24 设计,原试验见表 6.10。假设在该试验中加入四个中心点,在 x1=x2=x3=x4=0x_{1}=x_{2}=x_{3}=x_{4}=0 处观测到的四个过滤速率为 73、75、66 和 69。这四个中心点的平均为 y‾C=70.75\overline{y}_{C}=70.75,16 次因子试验的平均为 y‾F=70.06\overline{y}_{F}=70.06。由于 y‾C\overline{y}_{C} 与 y‾F\overline{y}_{F} 非常接近,我们猜想不存在很强的弯曲。

表 6.24 汇总了该试验的方差分析。表的上部我们拟合了全模型。纯误差的均方由中心点按下式计算:

MSE=SSEnC−1=∑Center points(yi−yˉc)2nC−1(6.31)M S_{E} = \frac{SS_{E}}{n_{C} - 1} = \frac{\sum_{\text{Center points}} (y_{i} - \bar{y}_{c})^{2}}{n_{C} - 1} \tag{6.31}

因此,在表 6.24 中[1],

MSE=∑i=14(yi−70.75)24−1=48.753=16.25M S_{E} = \frac{\sum_{i = 1}^{4} (y_{i} - 70.75)^{2}}{4 - 1} = \frac{48.75}{3} = 16.25

差值 y‾F−y‾C=70.06−70.75=−0.69\overline{y}_{F}-\overline{y}_{C}=70.06-70.75=-0.69 用于按式 6.30 计算方差分析表中的纯二次(弯曲)平方和,如下:

SSPure quadratic=nFnC(y‾F−y‾C)2nF+nC=(16)(4)(−0.69)216+4=1.51\begin{array}{r l} SS_{\text{Pure quadratic}} & = \frac{n_{F} n_{C} (\overline{{y}}_{F} - \overline{{y}}_{C})^{2}}{n_{F} + n_{C}} \\ & = \frac{(16) (4) (- 0.69)^{2}}{16 + 4} = 1.51 \end{array}

方差分析表明,在所探索的区域内没有二阶弯曲的证据。也就是说,不能拒绝零假设 H0:β11+β22+β33+β44=0H_{0}:\beta_{11}+\beta_{22}+\beta_{33}+\beta_{44}=0。显著效应是 A、C、D、AC 和 AD。约简模型的方差分析见表 6.24 的下部。该分析的结果与例 6.2 的结果一致,在例 6.2 中重要效应是用正态概率图法分离出来的。

表 6.24 例 6.7 的方差分析[2]

ANOVA for the Full Model

变异来源平方和DF均方FFProb > F
Model5730.9415382.0623.510.0121
A1870.5611870.56115.110.0017
B39.06139.062.400.2188
C390.061390.0624.000.0163
D855.561855.5652.650.0054
AB0.06310.0633.846E-0030.9544
AC1314.0611314.0680.870.0029
AD1105.5611105.5668.030.0037
BC22.56122.561.390.3236
BD0.5610.560.0350.8643
CD5.0615.060.310.6157
ABC14.06114.060.870.4209
ABD68.06168.064.190.1332
ACD10.56110.560.650.4791
BCD27.56127.561.700.2838
ABCD7.5617.560.470.5441
Pure quadratic curvature1.5111.510.0930.7802
Pure error48.75316.25
Cor total5781.2019

ANOVA for the Reduced Model

变异来源平方和DF均方FFProb > F
Model5535.8151107.1659.02<0.000
A1870.5611870.5699.71<0.000
C390.061390.0620.790.0005
D855.561855.5645.61<0.000
AC1314.0611314.0670.05<0.000
AD1105.5611105.5658.93<0.000
Pure quadratic curvature1.5111.510.0810.7809
Residual243.871318.76
Lack of fit195.121019.511.200.4942
Pure error48.75316.25
Cor total5781.2019

图 6.39 中心复合设计

在例 6.7 中,我们断定没有二次效应的迹象;也就是说,含 ACAC 和 ADAD 交互作用的 A、C、D 一阶模型是合适的。不过,总会有些情形需要二次项 (xi2)(x_{i}^{2})。为对 k=2k = 2 个设计因子的情形加以例示,假设弯曲检验显著,于是我们不得不假定二阶模型,例如

y=β0+β1x1+β2x2+β12x1x2+β11x12+β22x22+ϵy = \beta_{0} + \beta_{1} x_{1} + \beta_{2} x_{2} + \beta_{12} x_{1} x_{2} + \beta_{11} x_{1}^{2} + \beta_{22} x_{2}^{2} + \epsilon

遗憾的是,我们无法估计该模型中的未知参数(各 β\beta),因为有六个参数需要估计,而图 6.38 中的 22 设计加中心点只有五个独立试验。

解决这个问题的办法简单而非常有效:在 2k2^{k} 设计上再加上四次轴点试验,k=2k = 2 的情形如图 6.39a 所示。所得设计称为中心复合设计(central composite design),现在可以用它拟合二阶模型。图 6.39b 给出 k=3k = 3 个因子的中心复合设计。该设计有 14+nC14 + n_{C} 次试验(通常 3≤nC≤53 \leq n_{C} \leq 5),是拟合 k=3k = 3 个因子、含 10 个参数的二阶模型的高效设计。

中心复合设计广泛用于建立二阶响应曲面模型。这些设计将在第 11 章更详细地讨论。

本节最后给出关于使用中心点的一些补充建议和观察。

  1. 当因子试验在一个持续运行的过程中进行时,考虑把当前的操作条件(或配方)作为设计的中心点。这常常能让操作人员放心:试验中至少有部分试验是在他们熟悉的条件下进行的,因此所得结果(至少对这些试验而言)不太可能比通常情况更差。

  2. 当因子试验的中心点对应于常用的操作配方时,试验者可以用中心点处观测到的响应粗略检查试验期间是否发生了任何"异常"。也就是说,中心点响应应当与常规过程运行中历史上观测到的响应非常相似。操作人员常常会维护一张控制图来监控过程性能。有时可以把中心点响应直接标在控制图上,以检查试验期间过程运行的方式。

  3. 考虑按非随机顺序进行中心点处的重复试验。具体地说,在试验开始处或接近开始处做一两个中心点,在中部附近做一两个,在结束处附近做一两个。通过在时间上分散中心点,试验者就能对试验期间过程的稳定性作粗略检查。例如,如果在试验进行期间响应出现了趋势,把中心点响应对时间顺序作图就可能揭示出来。

  4. 有时试验不得不在几乎没有或完全没有关于过程变异的事先信息的情况下进行。在这种情况下,把两三个中心点作为试验的最初几次试验来做会很有帮助。这些试验可以提供变异的初步估计。如果变异的大小看起来合理,就继续;相反,如果观察到的变异比预想(或合理!)的更大,就停下来。在继续做其余试验之前先研究为什么变异如此之大,往往获益很多。

图 6.40 含一个定性因子和中心点的 23 因子设计

  1. 通常,当所有设计因子都是定量因子时才会使用中心点。不过有时会有一到几个定性(或分类)变量和几个定量变量。在这些情形下仍然可以使用中心点。为加以例示,考虑一个试验,它有两个定量因子时间和温度,各取两个水平;还有一个定性因子催化剂类型,也取两个水平(有机和无机)。图 6.40 给出这些因子的 23 设计。注意中心点被放在立方体中涉及定量因子的那两个相对面上。换句话说,只要那些子空间只涉及定量因子,中心点就可以在定性因子的高水平与低水平处理组合处进行。

值得注意的是,在 2k2^{k} 设计中加入中心点从来不是一种 D 最优设计策略。为加以例示,回顾我们在 6.7 节末尾构造的三个因子的 12 次试验 D 最优设计。该设计的 D 效率为 94.28%,而含四个中心点的 23 设计的 D 效率只有 70.64%。此外,在 12 次试验的 D 最优设计中模型参数的相对标准误为 0.306,而在含四个中心点的设计中为 0.354。正如所料,D 最优设计给出的模型参数估计更精确。图 6.41 的设计空间比例图比较了这两个设计的预测方差表现。图中较低的曲线是 D 最优设计的 FDS 曲线。显然,就在几乎整个设计空间上预测响应的能力而言,D 最优设计优于含四个中心点的 23 设计。不过,D 最优设计没有检出响应函数中潜在弯曲的能力。这两个设计之间的取舍需要试验者仔细考虑。

图 6.41 比较 12 次试验的 D 最优设计(下曲线)与含四个中心点的 23 设计(上曲线)的设计空间比例图

Footnotes
  1. 原文此处写作"表 6.22",但纯误差均方的计算就在紧邻的表 6.24 中,故按表 6.24 译出。——译者注

  2. 原文此处写作"Example 6.6",但加入中心点的试验是例 6.7,故按例 6.7 译出。本节后文中印作"例 6.6"的两处(“In Example 6.6, we concluded that there was no indication of quadratic effects” 以及"这些结果与例 6.2 一致"一句前后的交叉引用)同样指例 6.7,译文已按例 6.7 译出。——译者注