跳转至

P3-7.4 基准线应该用什么区间、什么条件来设定

Section ID: P3-7.4 Version: v2026.07.20

一旦理解了基准线是必要的,接下来立刻就会冒出下一个问题。那到底什么算平时? 读者很容易再次卡在这里。如果拿来和最近区间比较的过去区间是随意拼出来的,那么即使比较表能做出来,解释也会很容易晃动。所以,更好的先后顺序是先抓住:先写下比较问题只保留适合这个问题的候选,然后 再从剩下的候选里选出和当前样本条件最接近的那一组。

基准线不应该是 随便一堆过去数据的组合,而应该是 和当前正在看的样本属于同一类条件下生成的比较区间。如果动作类型不同、运行模式不同、区间长度不同,或者至少运行条件不相近,那么即使会得到差值,也很难说明这个差值到底意味着什么。

选错的基准线 为什么会出问题
混入不同工艺类型的过去平均值 原本不同的结构会被误读成变化
只用最近 3 条样本做出的平时值 基准线本身会摇得太厉害
把动作长度差很多的案例一起混成基准线 即使是同一特征列,解释基准也变了
把维护前后状态混在一起的基准线 运行状态变化和结构变化会被混在一起

所以,基准线并不只是 一个旧平均值。它是决定“当前样本应该对照到哪里去读”的比较对象。因此,首先要匹配的是“让当前样本具有可比性”的条件。

一般化的基准线设定顺序

如果把刚才说的顺序再压缩成一张表,就是下面这样。

步骤 先要决定什么 这一阶段想避免的错误
决定比较问题 当前状态应该拿去和过去的哪种状态比较? 问题都还没定,就先选平均值的错误
只保留可比较候选 它们是不是同一样本单位、同一条件、同一运行阶段? 把群体差异误读成变化的错误
选出最接近的候选 剩下的候选里,哪一组最像当前样本? 明明留下了好候选,却又为了方便退回到宽泛平均值的错误

这三个步骤不需要套上很强的方法论名词。关键在于:基准线本身也是比较设计的一部分。 只有比较问题先出现,参考区间才能被正确选出;只有先留下可比较候选,才能决定当前样本到底应该照着谁去读。

应该先匹配的条件

在建立基准线时,先确认下面四个条件,会更安全。

  1. 是不是同一样本单位?
  2. 是不是同一工艺类型或运行模式?
  3. 样本数是否足够支撑比较?
  4. 是不是处于重大运行状态变化之前或同一状态阶段?

把这四点缩成表,就是下面这样。

先要匹配的条件 为什么需要
样本单位一致 因为如果把完整动作和时点行混在一起,差值解释会直接坏掉
工艺/条件一致 避免把原本不同的群体差异读成变化
样本数足够 让基准线本身不要过度摇晃
运行状态一致 避免设备更换、策略变化、维护前后被随手混在一起

这并不是说要先去学复杂统计技术。在这个阶段,仅仅先把 什么算同一个群体 对齐,就已经能大幅减少比较错误。

NIST 关于管理图的说明里提到,要把过程看作处于控制状态,样本应来自 presumably the same essential conditions。本节里所说的 同一样本单位同一工艺/运行条件同一运行状态,就是把这句话改写到本书的数据比较语境之中。也就是说,这里的推广只用到一个层级:在相同条件下建立可比较的参考。

相同条件,比相同平均值更重要

选择基准线时,一个很常见的错误是:把“平均值看起来相近”的案例直接归在一起。但平均值相近,并不意味着它们属于同一个比较群体。如果工艺类型不同、动作长度不同、运行模式不同,那么即使平均值相同,也仍然可能代表完全不同的结构。

当前正在看的样本 更接近的基准线候选 不太合适的候选
type-A 的一次动作汇总表 过去 type-A 动作汇总表的集合 type-Btype-C 混在一起的整体平均
最近 20 条样本的聚合表 同条件下过去大约 20 条样本的聚合表 只有 3 条样本的小集合
维护之后的动作 维护之后的稳定区间 维护之前的长期平均

这张表的关键,不是 数字看起来像不像,而是 比较条件是不是相同。归根结底,选择基准线不是“把平均值相近的案例收集起来”,而是“留下一个能够回答当前样本同一问题的参考群体”。

用一个小图来看

flowchart TD
    A[基线候选]
    A --> B{样本单位相同吗?}
    B -->|否| X[不要使用]
    B -->|是| C{流程与模式相同吗?}
    C -->|否| X
    C -->|是| D{事件数量足够吗?}
    D -->|否| X
    D -->|是| E{运行阶段相同吗?}
    E -->|否| X
    E -->|是| F[用作基线候选]

这张图说明,选择基准线并不是去挑一个平均值,而是一步一步筛掉不满足比较条件的候选。也就是说,它与其说是在打印候选表,不如说更像是在抓住一个筛选结构:依次检查 同一样本单位同一工艺条件足够样本数同一运行状态

因此,这一节与其说是一份现场规则清单,不如说更准确地是在讨论:怎样选出一个可比较的参考群体(selecting a comparable reference group)。所谓选基准线,不是 挑一个过去平均值,而是按条件一步步收窄到一个真正可和当前样本比较的参考群体。

来源与参考资料

  • NIST/SEMATECH e-Handbook of Statistical Methods, What are Variables Control Charts?. 它说明样本应来自同一本质条件,因此强化了本节的标准:只有样本单位和运行条件一致的基准线候选才应该被留下来。 https://www.itl.nist.gov/div898/handbook/pmc/section3/pmc32.htm / 确认日期: 2026-07-20
  • U.S. Bureau of Labor Statistics, Base period. 它提供了“用于比较的参考期间”这一一般定义,因此也支持这里的说明:基准线候选不该是“随便一个过去区间”,而应被选成一个可比较的 reference period。 https://www.bls.gov/bls/glossary.htm / 确认日期: 2026-07-20