P3-7.4 基准线应该用什么区间、什么条件来设定¶
Section ID:
P3-7.4Version:v2026.07.20
一旦理解了基准线是必要的,接下来立刻就会冒出下一个问题。那到底什么算平时? 读者很容易再次卡在这里。如果拿来和最近区间比较的过去区间是随意拼出来的,那么即使比较表能做出来,解释也会很容易晃动。所以,更好的先后顺序是先抓住:先写下比较问题,只保留适合这个问题的候选,然后 再从剩下的候选里选出和当前样本条件最接近的那一组。
基准线不应该是 随便一堆过去数据的组合,而应该是 和当前正在看的样本属于同一类条件下生成的比较区间。如果动作类型不同、运行模式不同、区间长度不同,或者至少运行条件不相近,那么即使会得到差值,也很难说明这个差值到底意味着什么。
| 选错的基准线 | 为什么会出问题 |
|---|---|
| 混入不同工艺类型的过去平均值 | 原本不同的结构会被误读成变化 |
| 只用最近 3 条样本做出的平时值 | 基准线本身会摇得太厉害 |
| 把动作长度差很多的案例一起混成基准线 | 即使是同一特征列,解释基准也变了 |
| 把维护前后状态混在一起的基准线 | 运行状态变化和结构变化会被混在一起 |
所以,基准线并不只是 一个旧平均值。它是决定“当前样本应该对照到哪里去读”的比较对象。因此,首先要匹配的是“让当前样本具有可比性”的条件。
一般化的基准线设定顺序¶
如果把刚才说的顺序再压缩成一张表,就是下面这样。
| 步骤 | 先要决定什么 | 这一阶段想避免的错误 |
|---|---|---|
| 决定比较问题 | 当前状态应该拿去和过去的哪种状态比较? | 问题都还没定,就先选平均值的错误 |
| 只保留可比较候选 | 它们是不是同一样本单位、同一条件、同一运行阶段? | 把群体差异误读成变化的错误 |
| 选出最接近的候选 | 剩下的候选里,哪一组最像当前样本? | 明明留下了好候选,却又为了方便退回到宽泛平均值的错误 |
这三个步骤不需要套上很强的方法论名词。关键在于:基准线本身也是比较设计的一部分。 只有比较问题先出现,参考区间才能被正确选出;只有先留下可比较候选,才能决定当前样本到底应该照着谁去读。
应该先匹配的条件¶
在建立基准线时,先确认下面四个条件,会更安全。
- 是不是同一样本单位?
- 是不是同一工艺类型或运行模式?
- 样本数是否足够支撑比较?
- 是不是处于重大运行状态变化之前或同一状态阶段?
把这四点缩成表,就是下面这样。
| 先要匹配的条件 | 为什么需要 |
|---|---|
| 样本单位一致 | 因为如果把完整动作和时点行混在一起,差值解释会直接坏掉 |
| 工艺/条件一致 | 避免把原本不同的群体差异读成变化 |
| 样本数足够 | 让基准线本身不要过度摇晃 |
| 运行状态一致 | 避免设备更换、策略变化、维护前后被随手混在一起 |
这并不是说要先去学复杂统计技术。在这个阶段,仅仅先把 什么算同一个群体 对齐,就已经能大幅减少比较错误。
NIST 关于管理图的说明里提到,要把过程看作处于控制状态,样本应来自 presumably the same essential conditions。本节里所说的 同一样本单位、同一工艺/运行条件、同一运行状态,就是把这句话改写到本书的数据比较语境之中。也就是说,这里的推广只用到一个层级:在相同条件下建立可比较的参考。
相同条件,比相同平均值更重要¶
选择基准线时,一个很常见的错误是:把“平均值看起来相近”的案例直接归在一起。但平均值相近,并不意味着它们属于同一个比较群体。如果工艺类型不同、动作长度不同、运行模式不同,那么即使平均值相同,也仍然可能代表完全不同的结构。
| 当前正在看的样本 | 更接近的基准线候选 | 不太合适的候选 |
|---|---|---|
type-A 的一次动作汇总表 | 过去 type-A 动作汇总表的集合 | 把 type-B 和 type-C 混在一起的整体平均 |
| 最近 20 条样本的聚合表 | 同条件下过去大约 20 条样本的聚合表 | 只有 3 条样本的小集合 |
| 维护之后的动作 | 维护之后的稳定区间 | 维护之前的长期平均 |
这张表的关键,不是 数字看起来像不像,而是 比较条件是不是相同。归根结底,选择基准线不是“把平均值相近的案例收集起来”,而是“留下一个能够回答当前样本同一问题的参考群体”。
用一个小图来看¶
flowchart TD
A[基线候选]
A --> B{样本单位相同吗?}
B -->|否| X[不要使用]
B -->|是| C{流程与模式相同吗?}
C -->|否| X
C -->|是| D{事件数量足够吗?}
D -->|否| X
D -->|是| E{运行阶段相同吗?}
E -->|否| X
E -->|是| F[用作基线候选]
这张图说明,选择基准线并不是去挑一个平均值,而是一步一步筛掉不满足比较条件的候选。也就是说,它与其说是在打印候选表,不如说更像是在抓住一个筛选结构:依次检查 同一样本单位、同一工艺条件、足够样本数、同一运行状态。
因此,这一节与其说是一份现场规则清单,不如说更准确地是在讨论:怎样选出一个可比较的参考群体(selecting a comparable reference group)。所谓选基准线,不是 挑一个过去平均值,而是按条件一步步收窄到一个真正可和当前样本比较的参考群体。
来源与参考资料¶
- NIST/SEMATECH e-Handbook of Statistical Methods,
What are Variables Control Charts?. 它说明样本应来自同一本质条件,因此强化了本节的标准:只有样本单位和运行条件一致的基准线候选才应该被留下来。 https://www.itl.nist.gov/div898/handbook/pmc/section3/pmc32.htm / 确认日期: 2026-07-20 - U.S. Bureau of Labor Statistics,
Base period. 它提供了“用于比较的参考期间”这一一般定义,因此也支持这里的说明:基准线候选不该是“随便一个过去区间”,而应被选成一个可比较的 reference period。 https://www.bls.gov/bls/glossary.htm / 确认日期: 2026-07-20