이미지 검색을 사용해 보세요
검색창 이전화면 이전화면
최근 검색어
인기 검색어

소득공제 청년패스
기초부터 시작하는 강화학습/신경망 알고리즘
AI는 어떻게 게임을 할까
손민규
위키북스 2019.11.21.
베스트
IT 모바일 top100 3주
가격
27,000
10 24,300
YES포인트?
1,350원 (5%)
5만원 이상 구매 시 2천원 추가 적립
결제혜택
카드/간편결제 혜택을 확인하세요

이미 소장하고 있다면 판매해 보세요.

  •  국내배송만 가능
  •  문화비소득공제 가능

위키북스- 데이터 사이언스 시리즈

이 상품의 시리즈 알림신청

이 상품의 태그

상세 이미지

책소개

목차

01장: 인공지능이란?

머신러닝의 종류
__지도학습
__비지도학습
__강화학습
강화학습과 신경망
이 책의 구성

02장: 강화학습

강화학습의 기본 요소
__환경
__상태 (S)
__에이전트
__행동 (A)
__상태전이확률 (P)
__보상 (R)
__수익 (G)
__정책 (r)
__에피소드
__마르코프 의사결정과정 (MDP)
환경과 에이전트 준비
가치함수 : 상태/행동의 가치 계산
__상태가치함수 : Vr
__행동가치함수 : Qr
동적계획법 : 최적 정책 선택
__정책 평가
__반복 정책 평가
__정책 개선
__정책 반복
__가치 반복
몬테카를로 방법
__몬테카를로 방법의 Prediction
__몬테카를로 방법의 Control
시간차 학습
__시간차 학습의 Prediction
__시간차 학습의 Control : SARSA(On-policy)
__시간차 학습의 Control : Q-learning(Off-policy)
__Double Q-learning
__정책 그레이디언트 : 액터-크리틱
함수 근사
함수 근사 : TD(0) Prediction
함수 근사 : Q-learning

03장: 인공신경망

퍼셉트론
손실함수
__평균제곱오차
__교차엔트로피오차
경사하강법
퍼셉트론의 학습
__숫자 외우기
__선형 함수 근사
__비선형 함수 근사
다층 퍼셉트론
활성화 함수
__시그모이드 함수
__하이퍼볼릭탄젠트 함수
__ReLU 함수
__소프트맥스 함수
오차역전파법
__오차역전파법이란?
__중간층과 출력층 사이의 가중치와 편향 학습
__입력층과 중간층 사이의 가중치와 편향 학습
__비선형 함수 근사
학습 최적화
__일정 비율 감소
__모멘텀
__AdaGrad
__RMSProp
__Adam
__드롭아웃
__배치 정규화
__그 밖의 방법
배치 경사하강법, 확률적 경사하강법, 미니배치 경사하강법
__배치 경사하강법
__확률적 경사하강법
__미니 배치 경사하강법
__에폭
케라스를 이용한 신경망 구현
합성곱신경망
__합성곱신경망이란?
__합성곱층
__채널
__스트라이드
__패딩
__풀링층
__플래튼층
케라스를 이용한 합성곱신경망 구현
__손글씨 데이터
__손글씨 데이터 전처리
__합성곱신경망 구축
__학습과 결과 확인

04장: 인공지능 만들기: 틱택토 게임

틱택토 준비
인간 플레이어
랜덤 플레이어
게임 진행 함수
몬테카를로 플레이어
Q-learning 플레이어
DQN 플레이어

부록A: 참고 자료

A.1 미분
A.2 편미분
A.3 연쇄법칙

저자 소개 1

일본 규슈 대학에서 인공지능으로 박사 학위를 받은 후 소니 반도체에서 데이터 분석, 알고리즘 및 시스템 개발, 사원 대상 통계 알고리즘 강의를 진행했으며, 현재 삼성전자에서 데이터 분석, 알고리즘 개발 업무를 하고 있다. 저서로 『데이터 분석을 떠받치는 수학』, 『기초부터 시작하는 강화학습/신경망 알고리즘』이 있으며, 옮긴 책으로는 『가장 쉬운 딥러닝 입문 교실』, 『실전! 딥러닝』, 『파이썬 데이터 분석 실무 테크닉 100』, 『데이터 해석학 입문』 등이 있다.

손민규의 다른 상품

품목정보

발행일
2019년 11월 21일
쪽수, 무게, 크기
312쪽 | 175*235*30mm
ISBN13
9791158391768

리뷰/한줄평2

리뷰

첫번째 리뷰어가 되어주세요.

한줄평

7.0 한줄평 총점

클린봇이 부적절한 글을 감지 중입니다.

설정