joyf***
2020-09-20

웹에 존재한다면 그것이 어떤 형태이든 데이터로 추출할 수 있다. 필요한 무기는 이 책과 파이썬뿐. BeautifulSoup, 셀레니움, 테서랙트 등 강력한 파이썬 라이브러리 사용법과 함께 API, 인증, 이미지 및 텍스트 인식, 로그인 처리 등 웹 크롤링의 기초부터 고급 기법까지 종합적으로 다루는 유일한 책. 실제 업무와 생활에 적용할 수 있는 예제가 가득하다. 2판은 예제를 추가 및 업데이트했고 모던 웹에서 거의 모든 종류의 데이터를 가져오는 방법을
혹시 크롤러 아세요.
책의 영어 제목은 Web Scraping with Python 인데요.
먼저 Web Scraping을 알아야 할 것 같아요.
웹 스크레이핑은 인터넷에서 자동으로 데이터를 수집하는 일입니다.
바로 웹을 통해서 스크랩 하는 일을 하는 프로그램이 웹 크롤러입니다.
웹 스크레이핑을 만들기 위해서는 데이터 분석, 자연어 처리, 정보 보안 같은 다양한 프로그램 테크닉을 알아야 합니다.
그래서 사람들이 어디서부터 시작해야 할지 갈피를 잡지 못하죠.
저자는 이런 사람들을 위해서 이 책을 만들었다고 합니다.
웹 스크레이핑 작업에 관한 상세한 가이드를 제공하는 것이 이 책의 목적입니다.
중급 이상의 파이선 개발자가 보기에 적당한 책입니다.