해결된 질문
작성
·
325
0
예전에 문제를 풀 땐 별 생각이 없었는데 다시 보니 Pclass를 꼭 범주형으로 지정할 이유가 있을까요? 클래스가 등급이면 수치형으로 봐도 되지 않을까요?
from statsmodels.formula.api import logit
model = logit('Survived ~ C(Pclass) + Gender + SibSp + Parch', data=df).fit()
model.params['Parch']
다시 풀어보니 실제 문제에서 저렇게 나온다면 범주형으로 지정해야할지 수치형으로 그대로 둘지 결정하기 애매할 것 같아서 여쭤봅니다.
답변 1
1
Pclass(등급)는 숫자이지만 범주형 데이터여서 C()를 지정했어요. 등급은 가족 수와 달리 연속형 데이터는 아니에요~!
문제가 어떻게 나올지 모르지만 논란을 만들지 않기 위해서는 누구나 알 수 있는 상식선에서 범주형 데이터이거나 범주형이라는 안내가 있다면 C()로 변경이 필요할 것 같습니다.