Head First Data Analysis : 당신을 최고의 데이터 분석가로 이끌어줄 마법 같은 학습서
세상에는 수많은 데이터가 있고, 그것을 어떻게 이해하느냐는 당신의 몫입니다. 어디서부터 시작할까요? 『Head First Data Analysis』는 당신이 엑셀이나 오픈오피스, 나아가서는 R을 사용하여 데이터를 조직화하고, 산포도와 히스토그램에서 의미 있는 패턴을 찾아내고, 휴리스틱을 사용하여 결론을 도출하고, 실험과 가설 검정을 통해 미래를 예측하게 해줍니다. 또한 명쾌한 시각화를 통해 당신이 발견한 것을 보여줍니다.
혹시 새 제품의 성공 가능
- 저자 : 마이클 밀튼
- 번역 : 김경태
- 출간 : 2013-04-11
근 몇 년전부터 IT업계에서 떠오른 화두를 말하라 하면 대다수의 IT업계의 종사자들은 Big Data를 언급할 것이다. 폭발적으로 증가한 Data를 이용하여 Business Insight를 찾는다는 Big Data Trend는 미래 기업의 생존을 결정할 요소라고 말하는 사람도 있다.
사실 Big Data라는 주제의 근저를 들어다보면 분석 대상 데이터의 범위가 확대되었다는 것이지, 기존에 있던 데이터 분석에서 벗어나지는 않는다.
달리 말한다면, Big Data로 인해 Data에 대한 관심이 과거 어느 때보다 높아졌으며, 데이터 분석 능력에 대한 중요성이 강조되는 시대가 도래되었다는 것이다.
하지만, 데이터 분석이라는 것이 말로는 쉽지만 막상 자신이 한다면 그렇게 만만치 않은 업무라는 것은 웬만한 사람들은 느낄 것이다. 당장 고등학교 때 배우는 수학의 범위를 보아도 이산 분포, 분산, 표준 편차 등 (데이터 분석에 필요한) 통계 수학 영역은 미적분과 더불어 가장 골머리를 썩히는 분야지 않는가?
개인적으로 데이터 분석에 대한 학습이 필요하다고 느끼면서도 그 어려움에 주저하던 차에 Head First Data Analysis를 만나게 되었다. 다른 Head First 시리즈처럼 쉽고 친절하게 나를 데이터 분석 분야로 이끌어 주겠지 하는 믿음을 가졌었고, 역시 나의 믿음을 저버리지 않았다.
책은 총 13장으로 구성되어 있는데, 각 장 별로 가상의 고객을 대상으로 데이터 분석하는 사례를 다루고 있다. 각 사례를 다루면서 여러 가지 데이터 분석 기법을 설명해주고 있다.
데이터 분석을 배울려면 통계에 관련된 수학을 피할 방법은 없다. (이 때문에 많은 사람들이 통계를 공부하는 것을 포기하기도 한다!) 역시나 이 책에서도 꽤 많은 수학 공식이 나온다. 하지만, Head First 시리즈답게 최대한 간결하게 수학 공식을 나타내고 있고 또한 어렵지 않게 이해할 수 있도록 도와주고 있다. 중학교 수학 정도로 쉽게 설명하기 때문에 내용을 이해하는게 큰 무리가 없다.
또한 데이터 분석 업무의 특성 상 엑셀과 같은 데이터 분석 도구를 사용하는 것은 피할 방법이 없다. (모든 데이터를 수기로 작성하고, 대조, 조회, 필터링 하는 것을 손으로 하는 어리석은 사람은 없을것이다.) 기본적으로 이 책의 주요 분석 도구는 엑셀이다. 엑셀 기능 중 약간의 함수만 사용하기 때문에 내용을 따라하는데 어려움을 느끼진 않았다. 후반부에 좀더 고급적인 데이터 분석을 할 때는 오픈소스 데이터 분석 도구로 유명한 R을 사용한다. R은 엑셀과 달리 사용이 무척 까다롭다. 하지만 책의 부록으로 R을 사용하는 방법을 수록해두어 사용에 큰 어려움을 겪지는 않는다.
국가가 선진국에 가까워질수록 사회 구성원들은 직관에 의거한 행동보다는 (데이터에 근거한) 확률에 의거하여 행동하는 경향을 보인다. (세계에서 가장 발전한 통계 분석은 모두 미국에서 나왔다!) 비단 Big Data가 아니더라도 우리나라에서 데이터 분석은 계속 중요성이 높아질 분야라고 생각한다. 이런 시대적 조류에 맞추어 데이터 분석을 학습하고 싶어하는 분들에게 Head First Data Analysis는 무척 괜찮은 데이터 분석 입문서라고 감히 추천한다.