빅데이터 기술은 기계 학습, 자연어 처리, 통계학, 분산 병렬 컴퓨팅 등의 기술이 결합된 시스템을 말한다. 이 책에서는 C 언어 예제를 통해 직접 실험하면서 데이터를 처리하는 기계 학습 원리를 학습할 수 있게 되어 있다. 기계 학습은 이론에 치우쳐 이해하기 어렵다는 단점이 있는데 간단한 코드와 실습을 통해 기초 원리를 쉽게 학습하게 구성되어 있다.
책은 200 페이지 분량으로 책 자체는 얇은 편이다.
책의 표지가 참 재미있어 더 흥미가 생긴 책이다.
IT 쪽의 책의 다양성은 일본이 국내보다 좋은거 같다.
아무래도 일본의 출판계의 상황이 그만큼 좋기에 많은 책이 나오는거 같아
참 부럽기도 하다.
국내의 출판계도 그만큼 좋으면 얼마나 좋을까 하는 생각도 든다.
개인적으로는 정가제가 과연...하는 생각이 든다.
이 책은 현재 나오는 빅데이타에 대한 것이라기보다는
데이타를 가지고 분석하는 기계학습의 원리에 대한 부분을 다루고 있다.
빅데이타가 이슈가 되다보니
데이타를 분석하는 부분에 대해서도 관심이 많이 가는 듯하다.
2장의 통계적 방법에 대한 부분은 사실 실무에서
기초데이타를 가지고 여러 단계로 그 정보를 추출하여 통계를 만들어내는 방법과
동일하다.
방법에 있어서는 DB 데이타를 처리하거나 책에서 다룬 파일 데이타를 가지고 처리한다.
대용량 데이타를 처리하기에 실시간 이라기 보단 배치프로그램으로 돌리는데
그렇게 추출하는 방법을 볼 수 있어 좋은 듯 하다.
책은 각 장마다 그에 해당하는 예제를 보여주고 그 예제의 실행결과를 보여준다.
각 예제소스가 그리 길지 않기에 소스를 보고 따라해보면
많은 도움이 될 듯 하다.
소스의 구현시는 어떤 구조로 구현을 할지 먼저 설명을 하고 있는 부분은 괜찮은 듯 하다.
다만 구현된 소스의 설명부분은 서술형식 보다는 좀더 보기편하게 되어 있다면 하는 아쉬움이 있다.
개념부분은 책은 얇지만 잘 설명되어 있는듯 하다.
개인적으로는 좀더 자세했으면 하는 아쉬움도 있다.