AI / 데이터 · 기초
경사 하강법(Gradient Descent)은 딥러닝 모델의 가중치를 업데이트하는 핵심 알고리즘입니다. 경사 하강법의 기본 원리를 간단하게 설명해주세요.
힌트 · 손실 함수의 기울기를 계산하여 경사가 가장 가파른 방향으로 이동하며 최소값을 찾아가는 과정입니다. 학습률이 이동 폭을 결정합니다.
손실 함수기울기학습률최적화반복
모범답안
경사 하강법은 딥러닝 모델이 학습하는 방식의 핵심입니다. 모델이 예측한 값과 실제 값 사이의 오차, 즉 손실 함수의 값을 최소화하는 방향으로 모델의 가중치를 조금씩 업데이트하는 과정이라고 생각하시면 됩니다.
기본 원리는 간단합니다. 먼저 손실 함수의 기울기를 계산합니다. 이 기울기는 현재 지점에서 손실 함수가 가장 가파르게 증가하는 방향을 알려줍니다. 우리는 손실을 줄여야 하므로, 기울기의 반대 방향으로 이동합니다.
이때 얼마나 이동할지를 결정하는 것이 학습률입니다. 학습률이 너무 크면 최적점을 지나쳐 버릴 수 있고, 너무 작으면 학습 속도가 매우 느려질 수 있습니다. 이 과정을 반복하면서 손실 함수가 최소가 되는 지점, 즉 최적의 가중치 값을 찾아가는 것이 경사 하강법입니다.
읽었다면, 이제 직접 답해볼 차례예요
패스잇 앱에서 이 질문에 말로 답하면 AI가 꼬리질문까지 이어가며 1:1 코칭합니다.
함께 보는 딥러닝 면접 질문
- 인공신경망(Artificial Neural Network, ANN)의 기본 구조를 구성하는 주요 요소들(입력층, 은닉층, 출력층, 노드, 가중치, 편향)에 대해 설명해주세요.
- 활성화 함수(Activation Function)는 인공신경망에서 어떤 역할을 하며, 비선형 활성화 함수를 사용하는 주된 이유는 무엇인가요?
- 딥러닝 모델 학습 시 사용되는 손실 함수(Loss Function)의 역할은 무엇이며, 회귀(Regression) 문제와 분류(Classification) 문제에서 주로 사용되는 손실 함수 각각의 예를 들어 설명해주세요.
- 딥러닝 모델을 학습할 때 흔히 발생하는 문제인 과적합(Overfitting)과 과소적합(Underfitting)은 각각 무엇을 의미하며, 이들이 모델 성능에 미치는 영향은 무엇인가요?
- 과적합(Overfitting)을 방지하기 위한 대표적인 정규화(Regularization) 기법 세 가지(L1, L2, Dropout)에 대해 간략하게 설명해주세요.
- ResNet과 VGG 네트워크의 주요 차이점은 무엇이며, ResNet이 깊은 네트워크에서 VGG보다 더 좋은 성능을 보이는 핵심적인 이유를 설명해 주세요.