P3-7.4 기준선은 어떤 구간과 조건으로 잡아야 하는가¶
Section ID:
P3-7.4Version:v2026.07.20
기준선이 필요하다는 말을 이해한 뒤에는 곧바로 다음 질문이 나옵니다. 그러면 무엇을 평소로 잡아야 하는가? 바로 이 지점에서 다시 막히기 쉽습니다. 최근 구간과 비교할 과거 구간을 아무렇게나 모으면, 비교표는 만들어져도 해석은 쉽게 흔들립니다. 그래서 여기서는 비교 질문을 먼저 적고, 그 질문에 맞는 후보만 남기고, 남은 후보 중 지금 샘플과 가장 같은 조건의 묶음을 고른다는 순서를 먼저 붙잡는 편이 좋습니다.
기준선은 과거 데이터 아무 묶음이 아니라, 지금 보고 있는 샘플과 같은 종류의 조건에서 만들어진 비교 구간이어야 합니다. 같은 동작 유형인지, 같은 운전 모드인지, 같은 구간 길이인지, 최소한 비슷한 운영 조건인지가 맞지 않으면 차이값은 생겨도 그 차이가 무엇을 뜻하는지 말하기 어려워집니다.
| 잘못 잡은 기준선 | 왜 문제가 되는가 |
|---|---|
| 다른 공정 유형을 섞은 과거 평균 | 원래 다른 구조를 변화처럼 읽게 된다 |
| 최근 3건만으로 만든 평소값 | 기준선 자체가 너무 쉽게 흔들린다 |
| 동작 길이가 크게 다른 사례를 함께 묶은 기준선 | 같은 특징 열이라도 해석 기준이 달라진다 |
| 유지보수 직후와 이전 상태를 한데 묶은 기준선 | 운영 상태 변화와 구조 변화가 섞여 버린다 |
즉 기준선은 단순히 오래된 평균이 아닙니다. 기준선은 현재 샘플을 어디에 비춰 읽을지 정하는 비교 상대입니다. 그래서 현재 샘플과 비교 가능한 조건을 먼저 맞추는 일이 중요합니다.
일반화된 기준선 설정 순서¶
방금 말한 순서를 표로 줄이면 다음과 같습니다.
| 단계 | 먼저 정해야 할 것 | 여기서 피하려는 오류 |
|---|---|---|
| 비교 질문 정하기 | 지금 상태를 과거 어느 상태와 비교할 것인가 | 질문이 없는데 평균부터 고르는 오류 |
| 비교 가능한 후보만 남기기 | 같은 샘플 단위, 같은 조건, 같은 운영 단계인가 | 다른 집단 차이를 변화처럼 읽는 오류 |
| 가장 가까운 후보 고르기 | 남은 후보 중 어느 묶음이 지금 샘플과 가장 같은가 | 후보를 남겨 놓고도 편의상 넓은 평균으로 돌아가는 오류 |
이 세 단계는 강한 방법론 이름을 붙일 필요가 없습니다. 핵심은 기준선도 비교 설계의 일부라는 점입니다. 먼저 비교 질문이 있어야 기준 구간을 고를 수 있고, 비교 가능한 후보를 남겨야 지금 샘플을 어디에 비춰 읽을지 정할 수 있습니다.
먼저 맞춰야 하는 조건¶
기준선을 만들 때는 아래 네 가지를 먼저 확인하는 편이 안전합니다.
- 같은 샘플 단위인가
- 같은 공정 유형이나 운전 모드인가
- 비교할 만큼 표본 수가 있는가
- 운영상 상태가 크게 바뀌기 전 구간인가
이 네 가지를 표로 줄이면 다음과 같습니다.
| 먼저 맞출 조건 | 왜 필요한가 |
|---|---|
| 샘플 단위 일치 | 동작 1회와 시점별 행을 섞으면 차이값 해석이 깨지기 때문 |
| 공정/조건 일치 | 원래 다른 집단 차이를 변화처럼 읽지 않기 위해 |
| 표본 수 확보 | 기준선 자체가 지나치게 흔들리지 않게 하기 위해 |
| 운영 상태 일치 | 설비 교체, 정책 변경, 유지보수 전후를 함부로 섞지 않기 위해 |
이 기준은 복잡한 통계 기법을 먼저 배우자는 뜻이 아닙니다. 이 단계에서는 무엇이 같은 집단인가를 먼저 맞추는 것만으로도 비교 오류를 크게 줄일 수 있습니다.
NIST의 관리도 설명은 공정이 통제 상태에 도달했다고 보려면 presumably the same essential conditions 아래에서 얻은 표본이 필요하다고 적습니다. 이 절에서 말하는 같은 샘플 단위, 같은 공정/운전 조건, 같은 운영 상태는 그 표현을 현재 책의 데이터 비교 문맥으로 풀어 쓴 것입니다. 즉 여기서의 일반화는 같은 조건 아래에서 비교 가능한 기준을 만든다는 수준까지만 사용합니다.
같은 평균보다 같은 조건이 먼저다¶
기준선을 고를 때 흔한 실수는 평균이 비슷해 보이는 사례를 그냥 함께 묶는 것입니다. 하지만 평균이 비슷하다고 해서 같은 비교 집단이라고 말할 수는 없습니다. 공정 유형이 다르거나 동작 길이가 다르거나 운영 모드가 다르면, 같은 평균도 전혀 다른 구조를 뜻할 수 있습니다.
| 지금 보고 있는 샘플 | 기준선에 더 가까운 후보 | 덜 적절한 후보 |
|---|---|---|
type-A 동작 1회 요약 표 | 과거 type-A 동작 요약 표 묶음 | type-B와 type-C를 섞은 전체 평균 |
| 최근 20건 집계 표 | 같은 조건의 과거 20건 안팎 집계 표 | 건수 3건짜리 작은 묶음 |
| 유지보수 이후 동작 | 유지보수 이후의 안정 구간 | 유지보수 이전 장기 평균 |
이 표의 핵심은 숫자가 비슷해 보이는가보다 같은 비교 조건인가를 먼저 보라는 점입니다. 결국 기준선 선택은 평균이 비슷한 사례를 모으는 일이 아니라 지금 샘플과 같은 질문에 답할 수 있는 참조 집단을 남기는 일입니다.
작은 도식으로 보기¶
flowchart TD
A[기준선 후보] --> B{같은 샘플 단위인가?}
B -->|아니오| X[사용하지 않음]
B -->|예| C{같은 공정과 모드인가?}
C -->|아니오| X
C -->|예| D{사건 수가 충분한가?}
D -->|아니오| X
D -->|예| E{같은 운영 단계인가?}
E -->|아니오| X
E -->|예| F[기준선 후보로 사용]
이 도식은 기준선 선택이 평균값 하나를 고르는 일이 아니라, 비교 조건을 단계별로 거르는 판단이라는 점을 보여 줍니다. 즉 후보 표를 출력하는 것보다 같은 샘플 단위, 같은 공정 조건, 충분한 표본 수, 같은 운영 상태를 차례로 맞춰 가는 선택 구조를 붙잡는 데 있습니다.
따라서 이 절은 특정 현장 규칙 모음이 아니라, 비교 가능한 참조 집단을 어떻게 고를 것인가(selecting a comparable reference group)의 문제로 읽는 편이 정확합니다. 기준선 선택은 과거 평균 하나 고르기가 아니라, 현재 샘플과 비교 가능한 참조 집단을 조건별로 좁혀 가는 과정입니다.
출처와 참고 자료¶
- NIST/SEMATECH e-Handbook of Statistical Methods,
What are Variables Control Charts?. 동일한 본질 조건 아래에서 얻은 표본이 필요하다는 설명을 제공하므로, 같은 샘플 단위와 운영 조건을 맞춘 기준선 후보만 남겨야 한다는 이 절의 기준을 보강합니다. https://www.itl.nist.gov/div898/handbook/pmc/section3/pmc32.htm / 확인일: 2026-07-20 - U.S. Bureau of Labor Statistics,
Base period. 비교 기준이 되는 참조 기간이라는 일반 정의를 제공하므로, 기준선 후보도 아무 과거 구간이 아니라 비교 가능한 reference period로 골라야 한다는 설명을 뒷받침합니다. https://www.bls.gov/bls/glossary.htm / 확인일: 2026-07-20