인프런 커뮤니티 질문&답변

몽하님의 프로필 이미지
몽하

작성한 질문수

[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)

카이제곱 검정 🆕 updated 2023.9

로지스틱 회귀 모형 문제에서 질문 드립니다.

해결된 질문

작성

·

313

0

예전에 문제를 풀 땐 별 생각이 없었는데 다시 보니 Pclass를 꼭 범주형으로 지정할 이유가 있을까요? 클래스가 등급이면 수치형으로 봐도 되지 않을까요?

from statsmodels.formula.api import logit

model = logit('Survived ~ C(Pclass) + Gender + SibSp + Parch', data=df).fit()

model.params['Parch']

 

다시 풀어보니 실제 문제에서 저렇게 나온다면 범주형으로 지정해야할지 수치형으로 그대로 둘지 결정하기 애매할 것 같아서 여쭤봅니다.

답변 1

1

퇴근후딴짓님의 프로필 이미지
퇴근후딴짓
지식공유자

Pclass(등급)는 숫자이지만 범주형 데이터여서 C()를 지정했어요. 등급은 가족 수와 달리 연속형 데이터는 아니에요~!

문제가 어떻게 나올지 모르지만 논란을 만들지 않기 위해서는 누구나 알 수 있는 상식선에서 범주형 데이터이거나 범주형이라는 안내가 있다면 C()로 변경이 필요할 것 같습니다.

몽하님의 프로필 이미지
몽하

작성한 질문수

질문하기