강화학습 첫걸음

텐서플로로 살펴보는 Q 러닝, MDP, DQN, A3C 강화학습 알고리즘

지은이

아서 줄리아니

옮긴이

송교석

출간일

2017.12.22

레벨

중급

평점

4.5(12명)

정가

18,000원

판매가

16,200원

총 결제 금액

10%

16,200원

적립 예정

810P

책 소개

저자

리뷰

추천 콘텐츠

자료

쪽수

180P

ISBN

9791162240298

브랜드

한빛미디어

텐서플로 코드로 입문하는 강화학습의 세계

알파고의 기반인 강화학습은 게임 AI나 자율주행 등 업계 활용성이 높아 인공지능의 미래로 단연 주목받고 있다. 이 책은 복잡한 이론을 두루뭉술하게 설명하는 대신, 예제 코드를 직접 돌려보며 강화학습 알고리즘을 익히게 도와준다. 기본적인 텐서플로 사용법은 알지만 강화학습은 처음인 개발자를 대상으로, 주요 강화학습 알고리즘이 어떤 원리이며 어떻게 구현할 수 있는지 알려준다. 오픈AI 짐의 카트-폴, 얼어붙은 강 같은 고전 문제부터 <둠> 같은 3D 게임까지 이르기까지 흥미로운 예제를 통해 Q 러닝, MDP, DQN, A3C 등 주요 강화학습 알고리즘을 알차게 배울 수 있다.

출판사 리뷰

인공지능의 미래로 주목받는 강화학습

쉽고 빠르게 코드로 익히기

하루가 멀다고 새로운 기법이 나오는 딥러닝 분야에서도 단연 주목받는 기법이 강화학습입니다. 알파고의 기반이기도 한 강화학습은 사람이 자전거 타는 법을 배울 때처럼 시행착오를 겪으며 더 나은 보상을 받는 쪽으로 행동 지침을 바로잡는 학습법입니다. 게임 AI나 자율주행 등 업계 활용성이 높아 인공지능의 미래로 더욱 주목받고 있습니다.

머신러닝, 딥러닝 커리큘럼을 체계적으로 익히는 것도 좋은 학습법이지만, 당면 과제 해결을 위해 강화학습부터 공부하는 수요도 늘고 있습니다. 이 책은 개발자를 위해 텐서플로 코드 중심으로 강화학습을 설명하는 가이드북입니다. 오픈AI 짐의 환경과 <둠> 같은 게임을 예로 들어 밴딧, MDP, Q 러닝, 더블/듀얼링 DQN, DRQN, A3C 등 주요 강화학습 알고리즘을 흥미롭게 배울 수 있습니다.

책 후반부에서는 짧게나마 강화학습과 관련된 몇 가지 심화 주제를 다룹니다. 에이전트 학습 과정을 시각화해보고, 환경 모델을 활용하는 방법을 살펴보며, 엡실론-그리디, 볼츠만, 베이지언 등의 여러 액션 선택 전략을 비교해봅니다. 학습하는 정책 자체를 학습하는 메타 강화학습의 개념도 알아봅니다.

이론을 어설프게 설명하려 들지 않고, 파이썬과 텐서플로 사용법도 다루지 않습니다. 고전적인 문제부터 최근 발표된 연구에 이르기까지, 주요 강화학습 알고리즘의 원리를 이해하고 구현하는 데 집중한 책입니다.

저자

리뷰

전체 평점

4.5

오탈자

등록된 오탈자가 없어요

오탈자를 발견하셨다면 작성해주세요.

18,000원

10%

16,200원

강화학습 첫걸음

텐서플로로 살펴보는 Q 러닝, MDP, DQN, A3C 강화학습 알고리즘

출판사 리뷰

저자

목차

리뷰

추천 도서

밑바닥부터 시작하는 딥러닝

딥러닝 첫걸음

신경망 첫걸음

텐서플로 첫걸음

오탈자

등록된 오탈자가 없어요