GAN(Generative Adversarial Network) 또는 Diffusion Model과 같은 생성 모델 학습 시 발생하는 모드 붕괴(Mode Collapse) 현상이 무엇인지 설명하고, 이를 완화하거나 해결하기 위한 고급 기법들(예: WGAN, VAE, Conditioning, Loss Function 개선 등)을 비교 분석하여 설명해 주십시오.
힌트 · 모드 붕괴는 생성 모델이 학습 데이터의 일부 모드만 생성하는 현상으로, 다양한 손실 함수, 아키텍처 변경, 조건부 생성 등을 통해 해결할 수 있습니다.
모범답안
모드 붕괴는 생성 모델이 학습 데이터의 모든 다양성을 포착하지 못하고, 특정 몇 가지 모드만 반복적으로 생성하는 현상입니다. 예를 들어, 사람 얼굴을 생성하는 모델이 항상 같은 표정이나 각도의 얼굴만 만든다면 모드 붕괴가 발생한 것입니다.
이를 해결하기 위한 고급 기법으로는 여러 가지가 있습니다.
WGAN(Wasserstein GAN)은 기존 GAN의 불안정한 학습을 개선하고 모드 붕괴를 완화하는 데 효과적입니다. Wasserstein 거리를 사용하여 판별자와 생성자 간의 거리를 측정함으로써, 더 부드러운 그래디언트를 얻고 학습 안정성을 높입니다.
VAE(Variational Autoencoder)는 생성 모델 자체의 구조적 특징으로 모드 붕괴를 완화하는 데 기여할 수 있습니다. VAE는 잠재 공간을 정규 분포로 가정하고 이를 통해 샘플링하기 때문에, 잠재 공간의 각 지점이 데이터의 특정 모드에 대응될 가능성이 높아져 다양성을 확보하는 데 유리합니다.
Conditioning은 생성 과정에 추가적인 정보를 주입하여 특정 모드를 생성하도록 유도하는 기법입니다. 예를 들어, 특정 클래스의 이미지를 생성하고 싶을 때 해당 클래스 정보를 조건으로 제공하면, 모델은 그 조건에 맞는 이미지만 생성하게 되어 모드 붕괴를 방지하고 원하는 결과물을 얻을 수 있습니다.
Loss Function 개선 또한 중요한 역할을 합니다. 예를 들어, Feature Matching이나 Minibatch Discrimination과 같은 기법들은 생성된 샘플들이 실제 데이터의 통계적 특성을 더 잘 반영하도록 유도하여 모드 붕괴를 줄입니다.
이러한 기법들은 각각 장단점을 가지며, 문제 상황에 따라 적절히 조합하여 사용하는 것이 중요합니다.
읽었다면, 이제 직접 답해볼 차례예요
패스잇 앱에서 이 질문에 말로 답하면 AI가 꼬리질문까지 이어가며 1:1 코칭합니다.
함께 보는 AI / 머신러닝 면접 질문
- 대규모 언어 모델(LLM)을 프로덕션 환경에 배포할 때, 서비스 지연 시간(latency)을 최소화하고 처리량(throughput)을 극대화하기 위한 아키텍처 설계 전략과 최적화 기법에 대해 설명하고, 특히 KV Cache, quantization, distillation의 적용 방안을 구체적인 예시와 함께 제시해 주십시오.
- 실제 서비스에 강화 학습(Reinforcement Learning) 에이전트를 적용할 때, 탐험(exploration)과 활용(exploitation)의 균형을 효과적으로 조절하기 위한 고급 전략에는 어떤 것들이 있으며, 특히 오프라인 RL(Offline RL) 기법이 이러한 문제 해결에 어떻게 기여할 수 있는지 설명해 주십시오.
- 프로덕션 환경에서 운영 중인 머신러닝 모델의 성능이 점진적으로 저하될 때, 데이터 드리프트(Data Drift)와 모델 드리프트(Model Drift)를 효과적으로 감지하고 진단하기 위한 모니터링 시스템 설계 방안과, 이에 대한 자동화된 대응 전략에 대해 설명해 주십시오.
- 의료 진단이나 금융 신용 평가와 같이 높은 투명성과 신뢰성이 요구되는 도메인에서, 블랙박스 AI 모델의 의사결정을 설명하기 위한 XAI(Explainable AI) 기법들을 비교하고, 특히 LIME, SHAP, 그리고 인과관계(Causal Inference) 기반 설명 기법의 장단점 및 실제 적용 시 고려사항을 논해 주십시오.
- 분산된 데이터 환경에서 프라이버시를 보호하면서 머신러닝 모델을 학습시키는 연합 학습(Federated Learning)의 핵심 원리를 설명하고, 통신 오버헤드(communication overhead), 이질적인 데이터 분포(non-IID data), 그리고 모델 수렴(convergence) 문제와 같은 주요 도전 과제를 해결하기 위한 고급 전략들을 제시해 주십시오.
- 대규모 그래프 데이터(예: 소셜 네트워크, 추천 시스템)에 Graph Neural Network(GNN)를 적용할 때 발생하는 확장성(scalability) 문제와 메모리 제약 사항을 극복하기 위한 고급 기법들(예: GraphSAGE, Cluster-GCN, Sampling 기반 기법)을 비교 분석하고, 각 기법의 장단점 및 적합한 적용 시나리오를 설명해 주십시오.