1. 다중회귀분석에서 y=b0+b1x1+b2x2+b3x3+b4x4에서 b1,b2,b3,b4 각각은 p값이 커서 유의하지 않은데 anova table에서 f통계량의 p값은 작아서 유의한 경우는 어떻게 해석해야될까요?
2. 유의하지 않은 독립변수는 제거하고 다시 회귀분석을 해야되나요?
3. 선형관계가 있을거라 예상되는데 개별 p값들이 큰경우는 다중공선성 외에 어떤 원인이 있을까요?
4. 분명히 다중공선성이 있을거라 예상되는데 vif값들이 10보다 작으면 어떻게 해야될까요?
통계학과 2학년 통린이 인데 답변 부탁드립니다! 감사합니다
2. 유의하지 않은 독립변수는 제거하고 다시 회귀분석을 해야되나요?
3. 선형관계가 있을거라 예상되는데 개별 p값들이 큰경우는 다중공선성 외에 어떤 원인이 있을까요?
4. 분명히 다중공선성이 있을거라 예상되는데 vif값들이 10보다 작으면 어떻게 해야될까요?
통계학과 2학년 통린이 인데 답변 부탁드립니다! 감사합니다
다변량수업 들으면 될듯
1. 은 유의미한 상관관계가없다고보는게맞다고봄. 변수가늘수록 F통계량은 커질수밖에없으니
감사합니다
1. 개별 변수는 통계적으로 유의하지 않아도 변수들의 선형결합으로 이루어진 모형은 그래도 랜덤한 것보다는 데이터를 설명하고 있다는 얘기입니다. 2. 예전에는 그냥 제거하고 그랬지만 실제 배경지식과 분석 맥락에서 중요한 변수는 함부로 없애면 안됩니다. 3. 의미있어 보이는 변수라고 해서 p값이 언제나 작아야 할 이유도 없습니다. 4. vif값이 작으면 그냥 놔두어도 상관없는 거지요. 분석은 배경 지식에 맞추어 설명할 수 있는지가 중요합니다. 수학적으로 p<0.05 아니면 그냥 버리고 이렇게 하면 실제 현실에는 엉뚱한 결과가 나올 수도 있습니다. 통계와 수학의 차이 중 하나입니다.