이번 장은 재해 복구(DR)와 백업을 다룬다.
아무리 잘 만든 시스템도 대규모 장애나 재해를 완전히 피할 수는 없다.
중요한 것은 그때 얼마나 빨리, 얼마나 적은 손실로 복구하느냐다.
이 장의 목표는 다음과 같다.
- RTO와 RPO의 뜻을 안다.
- 네 가지 DR 전략을 비용/속도로 비교한다.
- AWS의 백업 도구를 정리한다.
1. RTO와 RPO
DR을 이야기할 때 두 지표가 핵심이다.
- RTO(Recovery Time Objective): 복구 목표 시간. "얼마나 빨리 다시 살릴 것인가."
- RPO(Recovery Point Objective): 복구 목표 시점. "얼마만큼의 데이터 손실을 감수할 것인가."
RTO·RPO가 짧을수록 안전하지만 비용이 커진다.
서비스 중요도에 맞춰 목표를 정하는 것이 설계의 출발점이다.
2. 네 가지 DR 전략
AWS는 대표적인 DR 전략을 비용·속도 순으로 제시한다.
| 전략 | 개념 | RTO/RPO | 비용 |
|---|---|---|---|
| 백업 & 복원 | 백업만 떠 두고 필요 시 복원 | 느림(시간) | 최저 |
| 파일럿 라이트 | 핵심(DB)만 항상 켜 둠 | 중간 | 낮음 |
| 웜 스탠바이 | 축소판을 늘 돌림 | 빠름(분) | 중간 |
| 멀티 사이트 | 양쪽을 동일 규모로 상시 운영 | 즉시 | 최고 |
오른쪽으로 갈수록 빠르지만 비싸다. 서비스 등급에 맞춰 고른다.
3. AWS Backup
AWS Backup은 여러 서비스의 백업을 중앙에서 관리한다.
- EBS, RDS, DynamoDB, EFS 등을 한 정책으로 백업.
- 백업 주기와 보관 기간을 규칙으로 정한다.
- 다른 리전·계정으로 복사해 재해에 대비한다.
4. 멀티 리전 고려사항
한 리전 전체가 문제가 될 상황에 대비하려면 다른 리전에 복제를 둔다.
- S3 교차 리전 복제, RDS 리전 간 읽기 복제본, DynamoDB 글로벌 테이블 등.
- Route 53 장애 조치(13장)로 리전 간 전환을 자동화한다.
멀티 리전은 강력하지만 비용과 복잡성이 크므로, RTO/RPO 요구가 정말 높을 때 선택한다.
정리
- RTO(복구 시간)·RPO(허용 손실)로 목표를 먼저 정한다.
- DR 전략은 백업&복원 → 파일럿 라이트 → 웜 스탠바이 → 멀티 사이트 순으로 빠르고 비싸진다.
- AWS Backup으로 여러 서비스 백업을 중앙 관리한다.
- 최고 등급은 멀티 리전 + Route 53 장애 조치로 자동 전환한다.
다음 장에서는 지금까지 배운 것을 하나로 엮는 실전 아키텍처와 자격증 로드맵을 다룬다.
댓글 0
댓글은 운영자만 작성할 수 있어요.