ML 모델을 프로덕션 환경에 배포할 때, A/B 테스트 배포와 카나리(Canary) 배포 전략을 각각 어떤 상황에 적용할 수 있으며, 각 전략의 장단점은 무엇인지 비교 설명해 주세요.
힌트 · A/B 테스트는 새로운 모델의 비즈니스 임팩트 평가에, 카나리 배포는 위험을 최소화하며 점진적으로 새 모델을 적용할 때 유용합니다. 트래픽 분할 및 모니터링이 핵심입니다.
모범답안
ML 모델 배포 시 A/B 테스트와 카나리 배포는 각각 다른 목적과 상황에 맞게 활용됩니다.
A/B 테스트는 주로 새로운 모델의 비즈니스 임팩트를 정확하게 평가하고 싶을 때 사용합니다. 전체 사용자 트래픽을 두 그룹(기존 모델 그룹 A, 신규 모델 그룹 B)으로 나누어 각 그룹의 성능 지표를 비교합니다. 이를 통해 어떤 모델이 더 나은 성과를 내는지 객관적으로 판단할 수 있습니다. 장점은 명확한 성과 비교가 가능하다는 점이지만, 단점은 새로운 모델이 예상치 못한 문제를 일으킬 경우 전체 사용자에게 영향을 줄 수 있다는 위험이 있습니다.
카나리 배포는 신규 모델을 점진적으로 출시하여 위험을 최소화하는 데 초점을 맞춥니다. 소수의 사용자에게만 신규 모델을 먼저 적용하고, 문제가 없을 경우 점차 적용 범위를 확대합니다. 이를 통해 잠재적인 오류나 성능 저하를 조기에 발견하고 빠르게 롤백할 수 있습니다. 장점은 안정적인 배포와 빠른 문제 대응이 가능하다는 점이지만, 단점은 A/B 테스트만큼 명확한 성능 비교가 어렵고, 트래픽 분할 및 모니터링 설정이 복잡할 수 있습니다.
요약하자면, 비즈니스 성과 검증이 최우선이라면 A/B 테스트를, 안정성과 위험 관리가 중요하다면 카나리 배포를 선택하는 것이 좋습니다.
읽었다면, 이제 직접 답해볼 차례예요
패스잇 앱에서 이 질문에 말로 답하면 AI가 꼬리질문까지 이어가며 1:1 코칭합니다.
함께 보는 MLOps 면접 질문
- ML 모델을 프로덕션 환경에 배포하기 전에 모델 레지스트리(Model Registry)를 사용하는 주요 목적은 무엇이며, 모델 레지스트리가 제공하는 핵심 기능들을 구체적으로 설명해 주세요.
- ML 모델 개발 과정에서 수많은 실험이 이루어지는데, 이러한 ML 실험을 효율적으로 추적하고 관리하기 위한 방법과 MLflow Tracking과 같은 도구가 제공하는 이점을 설명해 주세요.
- 전통적인 소프트웨어 CI/CD 파이프라인과 MLOps의 CI/CD 파이프라인(Continuous Training/CT 포함)은 어떤 주요 차이점을 가지며, MLOps에서 CT가 왜 중요한지 설명해 주세요.
- 프로덕션 환경에 배포된 ML 모델의 성능을 지속적으로 모니터링해야 하는 이유는 무엇이며, 데이터 드리프트(Data Drift)와 컨셉 드리프트(Concept Drift)를 감지하는 방법과 대응 전략에 대해 설명해 주세요.
- 대규모 프로덕션 환경에서 모델 성능 저하를 일으키는 데이터 드리프트(Data Drift)와 컨셉 드리프트(Concept Drift)를 효과적으로 탐지하고, 이를 자동으로 완화하기 위한 MLOps 시스템 설계 방안에 대해 설명하고, 재학습(Retraining) 전략과 롤백(Rollback) 메커니즘을 포함하여 구체적인 구현 방안을 제시하시오.
- 실시간(Real-time) 서빙과 배치(Batch) 학습을 모두 지원하는 확장 가능한 피처 스토어(Feature Store)를 설계한다고 가정해 봅시다. 온라인 스토어와 오프라인 스토어 간의 데이터 일관성(Consistency)을 유지하고, 피처 검색 지연 시간(Latency)을 최소화하며, 데이터 거버넌스를 확보하기 위한 아키텍처 및 기술 스택 선택에 대해 설명하시오.