New
-
R Studio - Function, Data type
오늘은 R을 다룰 때 기본적으로 알아야 할 내용에 대해 다뤄보겠습니다. 크게 다음과 같습니다.사용자 지정 함수는 어떻게 생성하는가R의 Data type 종류1. FunctionR에서 mean(), sum(), apply() 같은 내장함수가 아닌 다른 함수를 만들어서 사용하고 싶을 때가 있습니다.이를 사용자 지정 함수라고 하는데 어떻게 설정할 수 있는지 알아봅시다. 먼저 인자로 어떤 수를 받고 그 수에 5를 더한 값을 return하는 함수를 만들고 싶다고 해봅시다.코드를 먼저 살펴보겠습니다.add_five 위와 같이 먼저 지정할 함수 이름을 써주고 해당 변수에 만들고 싶은 함수를 넣어줍니다.function()의 괄호 안에는 우리가 입력할 인자를 넣으면 됩니다.함수가 동작할 내용을 { } 안에 넣으면 되고..
더보기
-
데이터 전처리 (Preprocessing) (2) - [Python]
데이터 전처리 (Preprocessing) (1) - [Python]에서는 가지고 있는 Data set을 Feature와 Response로 나누는 작업, 결측치를 처리하는 작업, 그리고 Label Encoding과 One-Hot Encoding에 대해 알아봤습니다.자세한 내용은 밑의 링크를 참고바랍니다. 2024.09.03 - [ML] - 데이터 전처리 (Preprocessing) (1) - [Python] 데이터 전처리 (Preprocessing) (1) - [Python]머신러닝 모델링 전에 주어진 데이터의 전처리 과정은 필수적입니다.일반적으로 선형회귀, RandomForest, XGBoost 등의 모델을 훈련시키기 위해서는 적절한 데이터의 형태가 필요합니다. 또한, 실제compass-lee.tist..
더보기
-
데이터 전처리 (Preprocessing) (1) - [Python]
머신러닝 모델링 전에 주어진 데이터의 전처리 과정은 필수적입니다.일반적으로 선형회귀, RandomForest, XGBoost 등의 모델을 훈련시키기 위해서는 적절한 데이터의 형태가 필요합니다. 또한, 실제 데이터는 clean하지 않은 경우가 대다수이며 이 데이터를 그대로 사용한다면 모델의 성능이 안 좋을 가능성이 매우 크기 때문에 전처리 과정은 매우 중요하다고 볼 수 있습니다. 전처리 과정을 간단한 data set을 이용해서 살펴봅시다. 1. Feature(Predictor) 와 Response 나누기import pandas as pdimport numpy as npdata = pd.read_csv('data.csv') 데이터를 살펴보면, Feature로는 Country, Age, Salary가 있고이..
더보기
-
R Markdown 사용법
R Markdown이란?R이라는 언어를 사용하기 위해 RStudio라는 IDE를 많이 사용합니다.최근 대학교 수업을 들으며 RStudio 안의 기능인 R Markdown을 알게 되었는데 아주 편리하더라구요. 각설하고, 바로 알아보겠습니다. RStudio를 실행하게 되면 다음과 같은 화면을 보실 수 있습니다.평소에는 R Script에 코드를 작성하고 분석한 내용을 한글 파일로 옮겨서 보고서를 작성했다면, R Markdown은 이 작업을 한 번에 할 수 있도록 도와줍니다. 어떻게 사용하는 지 알아보도록 하겠습니다. R Markdown 열기 왼쪽 상단의 + 버튼을 누르고 R Markdown을 선택해주세요. Title에는 제목, Author에는 이름, Date에는 날짜를 쓰시면 되는데 이 항목들이 어디에 나타나..
더보기