Deep Learning - 딥러닝의 활성화 히트맵 시각화하기

이번 포스팅에서는 이미 훈련된 CNN의 활성화를 파악하는 방법 중 하나인 히트맵 시각화하는 방법에 대해서 정리해보도록 하겠습니다. 이 방법으로 저희는 이미지의 어느 부분이 CNN의 최종 분류 결정에 기여하는 가에 대해서 파악할 수 가 있습니다. 먼저 히트맵을 시각화하기 이전에 이미 훈련된 CNN 모델 중 하나인 VGG16 모델을 가져오도록 하겠습니다. from keras.applications.vgg16 import VGG16 from keras.preprocessing import image from keras.applications.vgg16 import preprocess_input , decode_predictions 그리고 이 모델을 이용해서 히트맵을 그리고자 하는 예시 사진을 하나 가져오겠습니..

Deep Learning 2020.11.08 0

Python - Matplotlib을 이용해서 데이터 시각화 하는 방법

github 주소 : github.com/sangHa0411/DataScience/blob/main/Amazon_BestSellers_Matplotlib.ipynb sangHa0411/DataScience Contribute to sangHa0411/DataScience development by creating an account on GitHub. github.com 이번 포스팅에서는 matplotlib을 이용하는 방법을 자세하게 정리하여서 데이터를 시각화하면서 matplotlib을 사용할 때 어떻게 해야하는지에 대해서 정리해보도록 하겠습니다. 먼저 Pandas를 이용해서 데이터를 불러오겠습니다 1. 막대그래프 author_List = df['Author'].value_counts()[:10] key..

Python 2020.11.05 0

Python - 데이터프레임에서 바로 그래프 그리기

이번 포스팅에서는 .csv 파일을 Pandas로 불러와서 만든 데이터프레임에서 간단하게 그래프를 Pie Chart(원 그래프) , Bar Chart (막대 그래프) 를 그리는 방법에 대해서 정리해보겠습니다. 먼저 데이터를 pandas를 이용해서 불러오겠습니다. 그 다음 데이터 구조를 한 번 확인해보겠습니다. 여기서 저희는 이산적인 속성인 sex 속성에 대해서 데이터를 시각화해보고자 합니다. 먼저 value_counts() 함수를 이용해서 각 속성의 갯수를 파악할 수 있습니다. 이를 이용해서 각 속성과 해당 속성의 대한 갯수를 값으로 해서 그래프를 그릴 수 있습니다. plt.figure(figsize=(12,5)) plt.title('Data Sex Rate' , fontsize=20) plt.ylabel..

Python 2020.11.01 0

Data Visualization - 구글 플레이스토어 데이터 분석 및 시각화하기 Part2

데이터 출처 : www.kaggle.com/lava18/google-play-store-apps Google Play Store Apps Web scraped data of 10k Play Store apps for analysing the Android market. www.kaggle.com github 주소 : github.com/sangHa0411/DataScience/blob/main/GooglePlayStore_Plotly.ipynb sangHa0411/DataScience Contribute to sangHa0411/DataScience development by creating an account on GitHub. github.com Part1 에서는 구글 플레이스토어 데이터를 가지고 각..

Data Visualization 2020.11.05 0

Python - 기존 그래프의 확대 부분 같이 그리기

먼저 matplotlib을 이용해서 2개의 그래프를 동시에 그려보겠습니다. plt.figure(figsize=(18,10)) plt.title('Price Prediction & Real Comparison' , fontsize=20) plt.ylabel('Price Scaled' , fontsize=15) plt.xlabel('Index' , fontsize=15) plt.plot(idx_List , Y_test , color = 'blue' , alpha=0.5 , label = 'Real Price') plt.plot(idx_List , preds , color = 'red' , alpha=0.5 , label = 'Predicted Price') plt.legend(fontsize=15) plt...

Python 2020.11.01 1

Python - 상관행렬을 이용한 각 속성간의 연관성 파악하기

이번 포스팅에서는 Pandas를 이용해서 불러온 데이터프레임에서 각 속성간의 관계를 파악하기 위해서 상관행렬을 구하고 이를 이용해보는 과정을 정리해보겠습니다. 상관행렬에 대한 이론을 간단하게 정리하자면 아래와 같습니다. 먼저 각 속성에 대한 분산과 속성들간의 공분산을 구해서 분산 - 공분산 행렬을 만듭니다. 근데 여기서 공분산 값을 최솟값 = -1 , 최댓값 = 1 로 만듬으로써 표준화하는 것이 상관행렬이고 이를 이용하는 것이 피어슨 상관계수입니다. 이제 이를 파이썬을 이용해 구현해보겠습니다. 먼저 Pandas를 이용해서 데이터를 불러오고 데이터 구조를 확인해보겠습니다. 이제 이 데이터를 기반으로 상관행렬을 구해보겠습니다. corr_Info = insurance.corr() df.corr() 함수를 이용..

Python 2020.11.01 0

Machine Learning - Bayesian Linear Regression을 이용한 보험 비용 예측하기 Part1

데이터 출처 : www.kaggle.com/teertha/ushealthinsurancedataset US Health Insurance Dataset Insurance Premium Charges in US with important details for risk underwriting. www.kaggle.com ipynb file : github.com/sangHa0411/DataScience/blob/main/Insurance_Charges.ipynb sangHa0411/DataScience Contribute to sangHa0411/DataScience development by creating an account on GitHub. github.com 이번 포스팅에서는 다음 포스팅에서 얘기할..

Machine Learning 2020.10.10 0

Machine Learning - Logistic Regression 심장 병 여부 예측하기

데이터 출처 : www.kaggle.com/ronitf/heart-disease-uci Heart Disease UCI https://archive.ics.uci.edu/ml/datasets/Heart+Disease www.kaggle.com ipynb file : github.com/sangHa0411/DataScience/blob/main/Heart_Disease.ipynb sangHa0411/DataScience Contribute to sangHa0411/DataScience development by creating an account on GitHub. github.com 먼저 Pandas를 이용해서 데이터를 불러오겠습니다. 데이터의 총 갯수는 303개인 것을 확인할 수 있습니다. 데이터의 속..

Machine Learning 2020.10.07 0

Data Visualization - Basemap을 이용한 서울의 각 시 위치 표현하기

데이터 출처 : www.kaggle.com/bappekim/air-pollution-in-seoul Air Pollution in Seoul Air Pollution Measurement Information in Seoul, Korea www.kaggle.com ipynb file : github.com/sangHa0411/DataScience/blob/main/Seoul_Pollution.ipynb sangHa0411/DataScience Contribute to sangHa0411/DataScience development by creating an account on GitHub. github.com 이번 포스팅을 통해서 서울의 공기 오염도 정도를 분석해보고자 합니다. Part1 에서는 서울의 각..

Data Visualization 2020.10.06 0