matplotlib 3

파이썬(Python) - matplotlib ③ 상자 그림 / 줄기잎 그림

1. 상자그림 (box plot) 5가지의 요약 수치 값으로 표현된다. 최소값(0), 제1사분위수(25), 중위수(50), 제3사분위수(75), 최대값(100) 사분위값 : np.percentile(객체,[0,25,50,75,100]) 1) 중앙값 : 관측값을 크기순으로 정렬한 후 가운데 위치하는 값 관측값이 홀수일때 중앙값 # 차례로 정렬 했을때 중간번째 있는 값 weight = Series([35,40,45,50,55,60,65]) statistics.median(weight) # 내부에서 이런 식이 돌아가고 있다. weight = Series([35,40,45,50,55,60,65]) weight = weight.sort_values() weight = weight.reset_index(drop=T..

파이썬(Python) - matplotlib ② histogram

histogram 자료가 모여 있는 위치나 자료의 분포에 관한 대략적인 정보를 한눈에 파악할 수 있는 장점은 있으나 구체적인 수치정보를 쉽게 알아볼수없는 단점이 있다. 예) ages=[21,24,26,27,29,31,37,39,40,42,45,50,51,59,60,68] 1. List 형식 # 키에 관한 데이터 (이산형 데이터) height = [157,163,180,162,186,178,173,152,156,184,170,171,172] type(height) 1) 도수분포표로 만들기 # 분할 구간 만들기 (150~160, 160~170, 170~180, 180~190) bins = [150,160,170,180,190] # pd.cut(객체, 구간, 구간 기준) # 구간 기준 기본값은 True blo..

파이썬(Python) - matplotlib ① pie chart / bar chart / line plot

1. 자료의 시각화 1) 자료 어떠한 가치 판단을 할 수 있는 근거가 되는 재료 문제해결을 위한 원재료로 처리되진 않은 숫자, 문자, 일련의 사실이나 기록들의 모임 2) 양적자료 (Qunatitative Data, 수치형 자료) 수치로 측정이 가능한 자료 테이블 생성할때 숫자로 되어있는거 양적자료이다. 연속형 자료(continuous data) : 실수형 예) commission_pct, 키, 몸무게 이산형 자료(discrete data) 정수형 예) 출생아수, 남학생수, 왼손잡이수 3) 질적자료(Qualitaive Data, 범주형 자료) 수치 측정이 불가능한 자료 자료의 내포하는 의미가 있는 자료 순위형 자료 (ordinal data) : 학점(A+,B,..), 매우좋아, 보통, 아주나쁘다 명목형 자..

반응형