최고의 데이터 분석가가 되기 위한 가장 첫번째 책
Head First Data Analysis : 당신을 최고의 데이터 분석가로 이끌어줄 마법 같은 학습서
세상에는 수많은 데이터가 있고, 그것을 어떻게 이해하느냐는 당신의 몫입니다. 어디서부터 시작할까요? 『Head First Data Analysis』는 당신이 엑셀이나 오픈오피스, 나아가서는 R을 사용하여 데이터를 조직화하고, 산포도와 히스토그램에서 의미 있는 패턴을 찾아내고, 휴리스틱을 사용하여 결론을 도출하고, 실험과 가설 검정을 통해 미래를 예측하게 해줍니다. 또한 명쾌한 시각화를 통해 당신이 발견한 것을 보여줍니다.
혹시 새 제품의 성공 가능
- 저자 : 마이클 밀튼
- 번역 : 김경태
- 출간 : 2013-04-11
마케팅과 사업팀 이외 데이터 통계를 직접 분석하는 경우는 흔치 않다. 주관적으로 분석되고 정의내려진 다양한 데이터들이 뉴스, 논문, 증권가 분석 자료에 널리 퍼져있기 때문이다. 기획자를 비롯한 대부분의 사람들은 주어진 통계 데이터를 인용하는 정도 수준이었다.
하지만, 시장에 "빅데이터"라는 이름을 달아버린 거대한 데이터에 대한 시장의 관심이 높아지며, 누구나 빅 데이터와 밀접해야 하는 것이 오늘 날의 현실이다. 오늘 이시간에도 무수히 많은 사용자 데이터가 축적되고 있지만 어떤 식으로 사용될지, 제안 해야 할지 감이 안잡힌다면, 직접 빅데이터를 분석,제안해야 하는 때가 왔다면 당연 "Head First"를 추천하겠다.
좋은 책을 고르는 가장 좋은 방법은 1, 말머리와 2, 목차를 읽었을 때, 내가 필요한 내용이 있는지를 살피는 것이다.
이 책은 처음 빅데이터를 다루기 시작한 사용자가 어떤 절차(커리큘럼)에 의해 정보를 배울 수 있는지부터 데이터를 정리/엑셀도구로 분석 통계 내리는 일 까지 데이터 분석의 A to Z를 보여준다.
제목만 보았을때, 감이 안오더라도 "Head First"는 "그림"과 "예시"가 함께하기 때문에 이해가 쉽다.
이 때문에 한빛미디어의 "Head First"를 먼저 구매하곤 한다. 보통 어떤 정보를 습득할 때 책을 구매하는 순서는
1)헤드퍼스트 2)오라일리 시리즈 3)그중에서도 쿡북으로 초입/학습/적용 의 단계를 거치곤 한다.
그 중 헤드퍼스트는 해당 정보 지식에 관하여 흥미를 가질 지, 어려움부터 가질 지를 보여주는 첫 단추이다.
헤드퍼스트는 그림과 사례, 연습문제가 함께하기 때문에 책에서 제안하는 "캐릭터"에 감정이입하며 같이 문제를 해결해나가는 듯한 느낌을 받는 것이 가장 큰 장점이다. 헤드퍼스트의 "쉽게 다가가기" 전략은 언제나 옳다.
각 챕터의 첫 장에는 위 이미지와 같이 제목, 이미지, 내용이 적혀있다. 중요한 키워드는 볼드 처리되어있으며, 한 장에서 다음에 배울 내용을 요약하여 보여준다.
독자와 대화하는 듯한 QnA와 연습문제 등을 통해서 지식을 반복 심화할 수 있다.
헤드퍼스트 데이터 아날리시스(Data Analysis)를 두 번 정도 반복하면 데이터 분석에 대한 기초를 확실히 다질 수 있다. 하지만 이 모든 내용은 어느정도의 "데이터를 추출 할 수 있는 환경"이 부여되었을 때 이루어진다. 책에서는 데이터가 어디에선가 제공되고 우린 분석만 하면 된다. 하지만 실제 시장에서는 어떤 데이터가 필요할 지 발로 뛰며 조사해야 하고, 생각보다 머리를 쓰는 때 보다 몸과 시간으로 매달리는 부분이 많다는 점도 간과해선 안된다.
책에서 나오는 방법은 어찌보면 고등학교, 통계 등의 시간에서 배운 내용을 엑셀로 옮기는 방법. 보기 좋게 정리하는 법의 확장된 버전일 지도 모른다. 하지만 기초를 간과하면 심화를 배울 수 없음을 기억해야 한다.