모집단에서 무작위 표본추출을 한다쳐
모집단 숫자가 수십 수백만이라 전수조사는 어려운 상황
상식적으로 표본사이즈가 크면 클수록 표본의 특성이 모집단의 특성(평균 표준편차 중간값) 이랑 비슷하게 갈 확률이 높아진다고 알고있는데 말이지
표본 사이즈가 어느 정도 되야 모집단이랑 충분히 비슷할걸로 기대할수 있을지. 혹시 정해진 숫자같은게 있으까??
모집단 숫자가 수십 수백만이라 전수조사는 어려운 상황
상식적으로 표본사이즈가 크면 클수록 표본의 특성이 모집단의 특성(평균 표준편차 중간값) 이랑 비슷하게 갈 확률이 높아진다고 알고있는데 말이지
표본 사이즈가 어느 정도 되야 모집단이랑 충분히 비슷할걸로 기대할수 있을지. 혹시 정해진 숫자같은게 있으까??
흔히 표본이 30이상이면 여러가지 좋은 일들이 생긴다고 알려져있음. 노파심에 덧붙이자면 너는 표본이 커지면 그 특정 표본자체가 모집단이랑 비슷해질거라고 생각하는거같은데
보통은 표본사이즈가 30 이상정도 되면 표본을 계속 뽑았을 때 그 표본들의 표본평균이 정규분포를 따른다는것으로부터 모집단에 대한 추정을 하는거임.
잘못된 생각이야? 전수조사해버리면 일치율이 100% 가 되잖아. 당연히 많으면 많을수록 좋을거 같은데
전수조사하면 일치율이 100프로가 되는 것은 맞음. 많으면 많을수록 좋은것도 맞음. 하지만 표본이 얼마나 모집단을 대표할수 있느냐는 질문은 표본의 크기보다도 다른 많은 요소들과 관련이 있기때문에 순전히 n이 몇 보다 커지면 뭐가 어떻게 되고 말하기가 굉장히 어려움.
그러니까 묻는 말에 직접적으로 대답을 하면, 표본 사이즈가 어느 정도 되야 모집단이랑 충분히 비슷할걸로 기대할수 있을지? 라고 물었는데 대답은 "그런 기대는 어지간해서는 하면 안 됨" 이 된다고 할 수 있음
조사하려는 모집단이 정규분포를 이루는 숫자인지 아니면 yes/no binary인지 이런 구체적 정보가 주어져 있다면 그땐 답이 있을까??
정규분포면 20이어도 충분함
그야 당연히 모집단의 특성에 따라 천차만별으로 다르지