비율 데이터로 여러 집단별로 의미있는 차이를 보이는지 확인하고 싶은데
구글 쳐보니까 proportion이나 percentage 이런거는 독립변수로 아노바 돌리면 안된다하네요
https://www.reddit.com/r/statistics/comments/3cdgu5/running_an_anova_for_proportion_data/
여기 레딧게이랑 비슷한 상황인데
통계를 하나도 몰라서 뭔소린지 모르겠어유
비율 데이터로 여러 집단별로 의미있는 차이를 보이는지 확인하고 싶은데
구글 쳐보니까 proportion이나 percentage 이런거는 독립변수로 아노바 돌리면 안된다하네요
https://www.reddit.com/r/statistics/comments/3cdgu5/running_an_anova_for_proportion_data/
여기 레딧게이랑 비슷한 상황인데
통계를 하나도 몰라서 뭔소린지 모르겠어유
anova가 가정하는 모형 자체가 보통 관측되는 값이 집단의 평균 + 오차일거라고 가정해서 그럼 proportion같은건 n개의 binary관측을 했다고 볼 수 있어서 저기서 logistic같은걸 추천하는거고. 근데 또 써져있는거처럼 표본이 크면 또 엄청 큰 상관은 없긴 함