묻고 답해요
141만명의 커뮤니티!! 함께 토론해봐요.
인프런 TOP Writers
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
lightbgm 관련 질문
안녕하세요 선생님!원핫인코딩 후 lightgbm을 적용했을때 아래와 같은 코드가 나오는데, 일단 제가 구하려는 rmse 값은 나오는데 아래와 같은 코드가 나오는 이유가 궁금합니다![LightGBM] [Info] Auto-choosing row-wise multi-threading, the overhead of testing was 0.000150 seconds. You can set force_row_wise=true to remove the overhead. And if memory is not enough, you can set force_col_wise=true. [LightGBM] [Info] Total Bins 386 [LightGBM] [Info] Number of data points in the train set: 3007, number of used features: 8 [LightGBM] [Info] Start training from score 12299.193216 [LightGBM] [Warning] No further splits with positive gain, best gain: -inf
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
원핫인코딩시 에러
원핫인코딩을 하면 항상 이런 에러를 만나게 되는데 어디가 잘못된건지 잘 모르겠습니다.(cols 에는 ['Gender', 'Ever_Married', 'Graduated', 'Profession', 'Spending_Score', 'Var_1'] 이렇게 들어가있다고 나옵니다)
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
1번문제
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요!질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요먼저 유사한 질문이 있었는지 검색해보세요df[:int(len(df)*0.7)]저는 위와 같이 적었는데 이렇게 적어줘도 상관없을까요?강의에서는 iloc를 사용해서요!
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
4회기출 작업2 원-핫 인코딩 안될때
선생님!노트북에 있는 코드 그대로 실행했는데위처럼 원-핫 인코딩이 안되는데 ㅠ에러도 안뜨고...이건 무슨 문제일까요? 강의 15분 35초 정도입니다
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 1-1문제에서 이렇게 하면 왜 틀린 답이 나올까요?
import pandas as pd df = pd.read_csv("basic1.csv") # age컬럼 오름차순 정렬 df['age']=df['age'].sort_values(ascending=True) # age컬럼 3사분위수, 1사분위수 구해서 절대값 차 구하기 print(df['age'].loc[24]) print(df['age'].loc[74]) print(int(abs((df['age'].loc[24])-(df['age'].loc[74]))))
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형1 모의문제3 - 9번
위의 에러가 발생하여 질문드립니다.맨 아래는 제가 작성한 전체 코드 이고,df['subscribed'] = pd.to_datetime(df['subscribed']) 위 코드에서 에러가 발생한 것입니다. from google.colab import drive drive.mount('/content/drive') import pandas as pd import numpy as np df = pd.read_csv('/content/drive/MyDrive/bigdata(빅분기 놀이터)/빅분기 놀이터 Dataset/members.csv') # print(df.head()) df['subscribed'] = pd.to_datetime(df['subscribed']) df['month'] = df['subscribed'].df.month df = df.groupby(df['month']).count() print(df.sort_values('subscribed').index[0])
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
[2유형] 부분점수
안녕하세요.혹시 2유형 부분점수도 존재할까요? 그리고 sklearn에는 rmse 함수가 없다고 하셨는데그러면 무조건 rmse로 평가지표로 문제가 나오면def(rmse) ~~ 함수 생성해 줘야하는건가요?
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
기출 7회 1유형 3번문제에서 이상치를 구하는 코드를 사용할때 이것도 맞는건가요??
q1 = df['CO2'].quantile(.25)q3 = df['CO2'].quantile(.75)IQR = q3 - q1-> sum(df['CO2'] < q1 - 1.5 IQR) + sum(df['CO2'] > q3 + 1.5 IQR)이렇게 코드를 써도 나중에 IQR 이상치를 구하는 문제에서 별 문제가 없을까요..?
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 1 모의고사 2번
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요!질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요먼저 유사한 질문이 있었는지 검색해보세요 a1 = a[['s1','s2','s3','s4','s5']]sum = a1.sum(axis=1)>0.1print(sum.sum()) 문제에서 요구한 칼럼을 뽑아서 새로운 데이터 프레임을 만들어서 코딩했습니다. 이렇게 하니 102개가 나왔는데, 어떤 부분에서 문제가 발생하는지 잘 모르겠습니다.
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
코랩의 노트북 작업시 질문입니다.
코랩의 노트북 작업시 질문입니다. 노트북에서 한번 따라쳐보고 밑에서 새로 혼자 작성해보는 식으로 해보는데요, 언제부턴가 한번 코드를 치고난 후에는, 코드가 자꾸 자동완성이 되서 치기도 전에 코드가 완성되더라구요.혹시 노트북내에서 자동완성 기능을 끌 수 있는 방법이 있나요?
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형1 모의문제1 - 문제2 질문
이렇게 제 나름대로 풀이를 적어서 실행시켜 보았는데, 계속 에러가 떠서 질문 드립니다!제가 작성한 코드 입니다.from google.colab import drive drive.mount('/content/drive') import pandas as pd import numpy as np df = pd.read_csv('/content/drive/MyDrive/bigdata(빅분기 놀이터)/빅분기 놀이터 Dataset/members.csv') cond1 = df.isnull().sum() / len(df) >= 0.3 df[cond1] = df[cond1].dropna() cond2 = (df.isnull().sum() / len(df) >= 0.2) | (df.isnull().sum() / len(df) < 0.3) df[cond2] = df[cond2].fillna(df[cond2].mode()[0]) print(len(df[df['f3'] == 'gold']))
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형1 모의문제1 오류
계속 이렇게 오류가 뜨고 파일이 안불러와지는데 어떻게 해야하나요..?
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
양측검정의 pvalue
양측검정의 pvalue는 해석할때 그대로 해석하면 되는걸까요?예를들어 검정결과가MannwhitneyuResult(statistic=27036.0, pvalue=0.9807458376150018) 이런식으로 나왔다면 귀무가설을 지지한다는 결과는 같지만, 양측검정이어서 pvalue가 0.98에 대한 1/2의 값인 0.49로 인해서 지지한다고 봐야할지, 아니면 그대로 0.98이어서 지지한다고 해석해야할지 헷갈립니다.
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
statsmodel.formula.api.ols와 sklearn.linear_model.LinearRegression의 차이
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요!질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요먼저 유사한 질문이 있었는지 검색해보세요선형회귀분석에서 statsmodel.formula.api.ols와 sklearn.linear_model.LinearRegression의 차이가 궁금합니다. 어떨 때 ols를 쓰고, 어떨때 LinearRegression을 쓰는지 구분이 잘 안돼요.
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형2 채점
작업형 2 풀이를 할 때 수치형 데이터들 따로 건들지 않고 id 부분만 삭제하고 object형 데이터들을 단순 삭제 하고 모델 학습 후 검증 데이터로 평가했을때 어느정도 %가 나와야지 채점을 할 때 만점 받을 수 있을까요?단순하게 데이터를 전처리해도 검증 데이터로 평가했을 때 90% 정도가 나온다면 하이퍼파라미터 변경이나 수치형 데이터 스케일링, object형 원핫, 레이블 인코딩을 굳이 할 필요는 없는 것일까요?
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
라이브러리 및 데이터 불러오기 그리고 EDA, 16:45 부분
저는 아무리 해도 계속 값들이 (0,0)으로 나오는데 어떤 부분이 잘못된 것 일까요?ㅜㅜ
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
작업형 2 질문드립니다.
학습 관련 질문을 남겨주세요. 상세히 작성하면 더 좋아요!질문과 관련된 영상 위치를 알려주면 더 빠르게 답변할 수 있어요먼저 유사한 질문이 있었는지 검색해보세요안녕하세요.좋은 강의 항상 감사드립니다.작업형2번 검증데이터 나누기 부분 질문드립니다.어떤 문제에서는 cols에 범주형 데이터를 제외하고 -> 랜덤포레스트(섹션10 작업형2신유형), 어떤 문제는 labelencoder -> 검증데이터 나누기 -> 모델 학습 및 평가로 이어지는데요. 범주형 데이터가 적을 경우 cols에 범주형 컬럼은 빼고 적은 후 (labelencoder 안하고) 바로 모델 학습을 해도 괜찮은가요?(섹션10 작업형2)검증데이터 나누기 작업이 들어간 문제들은 어떤 상황이라서 인가요? 꼭 필요한 작업인가요?감사합니다!
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
문단맞춤 설정법이 있을까요?
강의에서 선생님 결과값은 보기 좋게 나오는데저는 이렇게 컬럼이 뒤로 갈수록 칸이 보기가 안좋아서 설정법이 따로 있는지 문의 드립니다.
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
기출6 유형1 문의드립니다.
안녕하세요 문의드립니다.그룹바이 정의값을 df['월평균']으로 넣으면 오류가 나고df['월평균'] = df.groupby('연도')['총범죄'].sum()/12 df['월평균']result로 넣으면 오류가 안나는 이유가 뭘까요?result = df.groupby("연도")['총범죄'].sum()/12 result
-
해결됨[퇴근후딴짓] 빅데이터 분석기사 실기 (작업형1,2,3)
모델 randomstate 값
전 강의 분류에서 랜덤포레스트 모델 불러올 때는model = RandomForestClassifier(random_state=2022) randomstate 값 주었는데 이번 강의에서는model = LinearRegression() 값을 주지 않았네요. 전 강의에서는 baseline, 원핫 , 라벨 인코딩 등 여러번 비교하면서 평가해야해서 고정시켜준건가요? 이번 강의에서는 라벨인코딩만 사용하기로 해서 굳이 고정시킬 필요 없나요? 또한 이번 강의에서는 단순 object만 제거하는 baseline, 원핫 인코딩 라벨 인코딩 평가 점수를 비교하지 않는데 이유가 있을까요? 또한 랜덤포레스트, 선형회귀 등 여러 모델이 있는데 어떠한 경우에 각 모델을 사용해야 하는지 기준이 있을까요?