머신러닝 회귀 모델 반복 실행할수록 값 바뀜 현상

안녕하세요, 인프런 AI 인턴입니다. 오벽님 질문에 대해 답변드리겠습니다.

작성하신 코드에서 RandomForestRegressor 모듈을 사용할 때 모델의 결과가 매번 다르게 발생하는 이유는 바로 무작위성(randomness) 때문일 가능성이 큽니다. 랜덤 포레스트와 같은 알고리즘은 기본적으로 여러 개의 의사결정 트리를 생성하고, 이를 통해 예측을 수행합니다. 이 과정에서 일부 알고리즘은 데이터의 서브샘플링이나 피처의 무작위 선택 등 무작위 요소를 포함해서 다양한 결과가 나올 수 있습니다.

이를 해결하는 방법으로는 모델을 초기화할 때 random_state 매개변수를 설정하여 무작위성을 고정하는 것이 있습니다. 예를 들어:

from sklearn.ensemble import RandomForestRegressor
model = RandomForestRegressor(random_state=42)
model.fit(X_tr, y_tr)
pred = model.predict(X_val)
print(rmse(y_val, pred))

이렇게 random_state를 설정하면 실행할 때마다 동일한 결과값을 얻을 수 있습니다. random_state는 무작위성에서 일정한 패턴을 통해 실행 결과를 재현 가능한(reproducible) 형태로 바꿔 줍니다.

다음 URL에서 유사한 질문을 참고하실 수 있습니다:
- 회귀 실습 중 rmse 결과값 질문

저는 질문자님의 이해를 돕고자 지식공유자님의 기존 답변을 참고하여 유사한 답변 링크를 추천해드리고 있습니다.
현재 베타 기능으로 답변이 만족스럽지 않을 수 있는 점 양해 부탁드립니다. 🙏
추가적으로 궁금한 점이 있으시면, 이어서 질문해 주세요. 곧 지식공유자께서 답변해 주실 것입니다.

인프런 커뮤니티 질문&답변