AI / 데이터 · 중급
분류(Classification) 모델의 성능을 평가할 때 사용되는 지표인 Precision, Recall, F1-score, 그리고 ROC-AUC의 개념을 각각 설명하고, 특정 상황(예: 암 진단, 스팸 메일 분류)에서 어떤 지표가 더 중요하게 고려될 수 있는지 구체적인 예시를 들어 설명해 주세요.
힌트 · Precision은 예측의 정확도, Recall은 실제 양성의 재현율을 나타냅니다. F1-score는 둘의 조화 평균이며, ROC-AUC는 분류 모델의 전반적인 성능을 측정합니다. 상황에 따라 False Positive 또는 False Negative의 중요도가 달라집니다.
정밀도 (Precision)재현율 (Recall)F1-scoreROC-AUC임계값 (Threshold)
모범답안
면접관님, 분류 모델 성능 평가 지표에 대해 설명드리겠습니다.
Precision은 모델이 양성으로 예측한 것 중 실제 양성의 비율입니다. Recall은 실제 양성 중 모델이 정확히 양성으로 예측한 비율을 의미합니다. F1-score는 Precision과 Recall의 조화 평균으로, 두 지표를 균형 있게 고려할 때 유용합니다. ROC-AUC는 모델이 양성/음성을 얼마나 잘 구별하는지 나타내는 지표로, 0과 1 사이의 값으로 표현됩니다.
암 진단에서는 Recall이 더 중요할 수 있습니다. 암에 걸렸는데 음성으로 잘못 판단하면(False Negative) 치료 시기를 놓칠 수 있기 때문입니다. 반면, 스팸 메일 분류에서는 Precision이 더 중요할 수 있습니다. 정상 메일을 스팸으로 잘못 분류하면(False Positive) 중요한 정보를 놓칠 수 있기 때문입니다. 상황에 따라 어떤 오류가 더 치명적인지를 고려하여 적절한 지표를 선택해야 합니다.
읽었다면, 이제 직접 답해볼 차례예요
패스잇 앱에서 이 질문에 말로 답하면 AI가 꼬리질문까지 이어가며 1:1 코칭합니다.
함께 보는 AI / 머신러닝 면접 질문
- 신경망에서 활성화 함수(Activation Function)의 역할은 무엇이며, ReLU, Sigmoid, Tanh 함수 각각의 특징과 장단점을 비교하고, 현대 딥러닝 모델에서 ReLU 계열 함수가 주로 사용되는 이유를 설명해 주세요.
- 머신러닝 모델 학습 시 사용되는 손실 함수(Loss Function)의 개념과 역할에 대해 설명하고, 회귀 문제에서 주로 사용되는 MSE(Mean Squared Error)와 분류 문제에서 주로 사용되는 Cross-Entropy 손실 함수를 비교하여 설명해 주세요.
- 경사 하강법(Gradient Descent)의 기본적인 원리를 설명하고, SGD(Stochastic Gradient Descent), Adam, RMSprop과 같은 다양한 최적화(Optimizer) 알고리즘들이 어떻게 경사 하강법을 개선하는지 각각의 특징과 장단점을 비교하여 설명해 주세요.
- 대규모 언어 모델(LLM)을 프로덕션 환경에 배포할 때, 서비스 지연 시간(latency)을 최소화하고 처리량(throughput)을 극대화하기 위한 아키텍처 설계 전략과 최적화 기법에 대해 설명하고, 특히 KV Cache, quantization, distillation의 적용 방안을 구체적인 예시와 함께 제시해 주십시오.
- 실제 서비스에 강화 학습(Reinforcement Learning) 에이전트를 적용할 때, 탐험(exploration)과 활용(exploitation)의 균형을 효과적으로 조절하기 위한 고급 전략에는 어떤 것들이 있으며, 특히 오프라인 RL(Offline RL) 기법이 이러한 문제 해결에 어떻게 기여할 수 있는지 설명해 주십시오.
- 프로덕션 환경에서 운영 중인 머신러닝 모델의 성능이 점진적으로 저하될 때, 데이터 드리프트(Data Drift)와 모델 드리프트(Model Drift)를 효과적으로 감지하고 진단하기 위한 모니터링 시스템 설계 방안과, 이에 대한 자동화된 대응 전략에 대해 설명해 주십시오.