이번 포스팅에서는 Pandas를 이용해서 불러온 데이터프레임에서 각 속성간의 관계를 파악하기 위해서 상관행렬을 구하고 이를 이용해보는 과정을 정리해보겠습니다. 상관행렬에 대한 이론을 간단하게 정리하자면 아래와 같습니다. 먼저 각 속성에 대한 분산과 속성들간의 공분산을 구해서 분산 - 공분산 행렬을 만듭니다. 근데 여기서 공분산 값을 최솟값 = -1 , 최댓값 = 1 로 만듬으로써 표준화하는 것이 상관행렬이고 이를 이용하는 것이 피어슨 상관계수입니다. 이제 이를 파이썬을 이용해 구현해보겠습니다. 먼저 Pandas를 이용해서 데이터를 불러오고 데이터 구조를 확인해보겠습니다. 이제 이 데이터를 기반으로 상관행렬을 구해보겠습니다. corr_Info = insurance.corr() df.corr() 함수를 이용..