CHANGE · RECOVERY장애·패치의 역할과 동작 원리
장애·패치 업무의 핵심은 명령어 암기가 아니라 변경 전 상태와 변경 후 증거를 비교해 원인을 좁히는 것입니다. 프로세스가 active라는 사실과 사용자가 정상적으로 업무를 수행할 수 있다는 사실은 서로 다릅니다.
패치 전에는 대상 버전, 의존성, 저장소·DNS·프록시, 서명과 출처, 백업·복원 절차, 중단 기준을 확인합니다. 적용 후에는 서비스·포트·로그·외부 업무 기능을 같은 조건으로 재검증합니다.
1승인·기준선→
2패치·변경→
3계층별 검증→
4복구·롤백→
5동일 조건 재시험
그림 해설 · 승인과 기준선부터 적용, 검증, 롤백, 재검증까지 하나의 변경 절차로 관리합니다.
01변경 전에 결정할 것
변경 승인 범위와 담당자, 예상 영향, 백업 위치만이 아니라 실제 복원 명령과 롤백 결정권자를 정해야 합니다.
- 현재 배포판·커널·패키지 버전을 기록합니다.
- 호환 버전과 중간 업그레이드 경로를 확인합니다.
- 중단 기준과 다음 보고 시각을 사전에 합의합니다.
02계층별 사후 검증
패키지 설치 성공, 프로세스 실행, 포트 LISTEN, 로컬 헬스체크, 외부 사용자 업무 응답은 각각 다른 검증 단계입니다. 첫 단계 성공으로 전체 복구를 선언하면 안 됩니다.
- 로그는 장비명·필터·타임존과 함께 남깁니다.
- 커널·라이브러리 패치는 재부팅 필요 여부를 확인합니다.
- 정상 기능과 보안 취약 요청을 모두 다시 시험합니다.
03보고와 재발 방지
확인되지 않은 가설을 원인으로 단정하지 않고, 최초 보고에는 확인된 현상·영향·현재 조치·다음 보고 시각만 담습니다.
- 임시조치와 영구조치를 분리합니다.
- 발생·탐지·접수·조치·복구·종료 시각을 같은 타임존으로 기록합니다.
- 기술 분석 보고서와 고객용 요약 보고서를 분리합니다.