결과 해석

예측값이 이렇게 나왔는데 괜찮은가요

무명씨 · 2026-10-09 05:10 · 조회 0
교차검증으로 PLS 모델을 돌렸는데, 테스트 폴드에서 얻은 예측값이 학습 폴드 평균과 거의 동일하게 나와서 모델이 제대로 평가되고 있는지 확신이 서지 않습니다. 혹시 이렇게 예측값이 나오면 과대평가된 결과일 가능성이 있는지, 어떤 점을 확인하면 좋은지 알려주시면 감사하겠습니다.

댓글 1
SSRA 연구지원팀 2026-10-09 16:52
■ 예측 절차와 핵심 포인트 · 표본을 무작위로 k개의 겹으로 나눕니다. 일반적으로 k는 10으로 설정합니다. · 한 겹을 시험 겹으로 남기고 나머지 k-1 겹을 학습 겹으로 사용해 PLS 모형을 추정합니다. · 학습 겹에서 얻은 가중치와 경로계수, 적재값을 이용해 시험 겹 응답자의 내생변수 측정지표를 예측합니다. ■ 결과 해석 시 주의점 · 시험 겹을 예측할 때는 학습 겹의 평균과 표준편차만 사용합니다. 시험 겹의 정보를 섞으면 표본 밖 예측이 아니게 됩니다. · 예측값은 학습 겹 평균에 학습 겹 표준편차와 적재값을 곱한 후, 예측한 내생변수 점수를 다시 곱한 형태로 계산됩니다. 이때 실제 내생변수 응답을 사용하지 않으므로 과적합 위험이 낮습니다. 흔한 오해 많은 사용자가 “예측값이 학습 데이터와 거의 동일하면 좋은 모델”이라고 생각합니다. 그러나 교차검증에서 시험 겹을 완전히 새로운 사람으로 간주하고 예측해야만 외부 타당성을 평가할 수 있습니다. 시험 겹의 평균·표준편차를 그대로 쓰지 않으면 과대평가된 결과가 나타날 수 있습니다. 따라서 전체 과정을 r번(보통 10회) 반복해 평균을 구하는 것이 바람직합니다. 자세한 내용: https://ssra.or.kr/kc/post.php?id=189
댓글 작성은 로그인 후 이용할 수 있습니다.
댓글 쓰기