lynnm***
2020-10-25

이 책은 NumPy, pandas, matplotlib, IPython, Jupyter 등 다양한 파이썬 라이브러리를 사용해서 효과적으로 데이터를 분석하는 방법을 알려준다. pandas의 새로운 기능뿐만 아니라 메모리 사용량을 줄이고 성능을 개선하는 고급 사용법까지 다룬다. 또한 모델링 도구인 statsmodels와 scikit-learn 라이브러리도 소개한다. 연대별 이름 통계 자료, 미 대선 데이터베이스 자료 등 실사례로 따라 하다 보면 어느덧 여러
(파이썬 라이브러리를 활용한 데이터 분석 2판)
목차만 봐도 데이터 분석에 대한 기본적인 내용은 배울 수 있는 책이다.
역자가 MIT에서 수학 전공했고, 2008년부터 python으로 금융분석 했다면, 적어도 내가 알고있다고 생각하는 내용들 보다는 더 많은 것들을 알고, 익혔을 것이라 생각이 든다.
전체적인 내용을 보았을 때, 막 python을 시작하고 싶어하는 사람이라면 기초를 익히기에 굉장히 좋은 책같다.
최근 언니가 python을 시작해보고 싶다고 그랬는데,
python을 데이터 분석 목적으로 공부를 시작한다고 한다면 이 책도 같이 보라고 권유해야겠다.
물론 데이터분석을 할 때 여기에 나온 numpy, pandas 등의 것들만을 사용해서 하기는 어렵겠지만
그냥 kaggle같은 곳에 있는 간단한 문제들 풀면서 기초 공부하기엔 딱 적당한 책이다.