이미지 검색을 사용해 보세요
검색창 이전화면 이전화면
최근 검색어
인기 검색어

정가제 Free 180일 대여 PDF
eBook [단독 최저가][대여] 강화 학습
기초 개념부터 최신 알고리즘까지 이론과 실습을 통해 응용으로 가는 길 스마트한 PDF 필기 기능을 사용해 보세요!
오일석
한빛아카데미 2025.07.24.

본 대여 eBook은 동시에 최대 2대의 기기에서만 이용 가능합니다. 기기 변경이 필요한 경우, 기존 기기를 삭제한 후 다른 기기에서 새로 다운로드하여 이용하시기 바랍니다.

구매혜택

30% 단독 할인 + 180일 대여

가격
38,000
38,000
대여기간
180일
YES포인트?
0원
5만원 이상 구매 시 2천원 추가 적립
결제혜택
최대 2,000원 즉시할인
PDF 안내

이 상품은 구매 후 지원 기기에서 예스24 eBook앱 설치 후 바로 이용 가능한 상품입니다.

예스24만의 독보적인 PDF 필기 기능을 경험해 보세요!

상세 이미지

소개

목차

CHAPTER 01 소개
1 강화 학습이란
2 기계 학습 = 지도 학습 + 비지도 학습 + 강화 학습
3 성공 사례와 응용 분야
4 간략 역사
5 읽을거리
연습문제

CHAPTER 02 강화 학습 기초 다지기
1 환경과 상호작용하는 에이전트
2 파이썬으로 MDP 프로그래밍
3 랜덤 정책과 최적 정책의 기대 이득 비교
4 정책과 가치 함수
5 강화 학습의 난이도와 접근방법 이해
연습문제

CHAPTER 03 동적 프로그래밍
1 원리
2 벨만 방정식과 정책 반복 알고리즘
3 벨만 최적 방정식과 가치 반복 알고리즘
4 스토캐스틱 과업의 동적 프로그래밍
5 동적 프로그래밍의 특성과 한계
연습문제

CHAPTER 04 몬테카를로 방법
1 에피소드 발생기
2 탐험과 탐사의 균형
3 몬테카를로 방법으로 정책 평가
4 몬테카를로 방법으로 정책 학습
5 성능 향상 기법
연습문제

CHAPTER 05 시간차 학습
1 원리
2 정책 평가
3 Sarsa
4 Q-러닝
5 Q-러닝으로 블랙잭 게임 학습
6 Q-러닝으로 CartPole 학습
7 성능 향상 기법
8 관점 확장
연습문제

CHAPTER 06 신경망을 이용한 근사 방법
1 신경망 기초
2 신경망 구현
3 신경망을 이용한 Q-러닝
4 신경망 기반 Q-러닝 구현: CartPole 과업
5 신경망 기반 Q-러닝 구현: Blackjack 과업
6 신경망에 대한 논쟁과 새로운 길
연습문제

CHAPTER 07 딥러닝 방법
1 딥러닝으로 대전환
2 DQN
3 리플레이 메모리
4 딥러닝 기초
5 아타리 게임 환경
6 DQN을 이용한 퐁 아타리 게임
7 덧붙이는 말
연습문제

CHAPTER 08 정책 그레이디언트 방법
1 정책이 중심인 학습
2 REINFORCE 알고리즘
3 REINFORCE 프로그래밍: 이산 과업
4 연속 과업을 위한 정책 그레이디언트
5 REINFORCE 프로그래밍: 연속 과업
6 파이썬의 배열 연산을 이용한 속도 향상
연습문제

CHAPTER 09 행동가 - 비평가 방법
1 행동가와 비평가의 협력
2 편향-분산 트레이드오프
3 이익 함수
4 A2C와 A3C
5 A2C 프로그래밍: 이산 과업
6 A2C 프로그래밍: 연속 과업
연습문제

CHAPTER 10 신뢰 영역 방법
1 단조 정책 개선
2 TRPO 알고리즘
3 PPO 알고리즘
4 PPO의 효율 향상
5 PPO 프로그래밍: 연속 과업
연습문제

CHAPTER 11 정책 최적화와 DQN의 결합
1 동기와 전개
2 DDPG 학습 알고리즘
3 프로그래밍 실습: DDPG를 이용한 Hopper 과업 학습
4 TD3 학습 알고리즘
5 프로그래밍 실습: TD3을 이용한 Hopper 과업 학습
6 SAC 학습 알고리즘
7 프로그래밍 실습: SAC를 이용한 Hopper 과업 학습
8 벤치마킹 분석
연습문제

CHAPTER 12 흉내 학습
1 발상과 전개
2 행위 복제
3 역강화 학습
4 적대 흉내 학습
5 관찰 흉내
연습문제

CHAPTER 13 고급 응용
1 강화 학습으로 만든 고급 제품: 기회와 도전
2 비디오 게임
3 보드 게임
4 대규모 언어 모델
5 자율주행
6 로봇
7 인공일반지능을 향하여
연습문제

참고문헌
찾아보기

저자 소개 1

1992년부터 전북대학교 컴퓨터공학부 교수로 재직 중이다. 1984년에 서울대학교 컴퓨터공학부를 졸업하고, 1992년에 KAIST 전산학과에서 박사학위를 받았다. 한국정보과학회 SA(소프트웨어와 응용) 논문지와 한국콘텐츠학회 논문지의 편집위원장을 지냈다. 주요 연구 분야는 기계 학습과 컴퓨터 비전, 패턴인식이다. 저서로는 『IT CookBook, 컴퓨터 비전』(한빛아카데미, 2014년, 대한민국학술원 2015년 우수학술도서), 『패턴인식』(교보문고, 2008년, 문화체육관광부 2009년 우수학술도서), 『C 프로그래밍과 스타일링』(교보문고, 2009년), 『컴퓨터 스토리』(교보문
1992년부터 전북대학교 컴퓨터공학부 교수로 재직 중이다. 1984년에 서울대학교 컴퓨터공학부를 졸업하고, 1992년에 KAIST 전산학과에서 박사학위를 받았다. 한국정보과학회 SA(소프트웨어와 응용) 논문지와 한국콘텐츠학회 논문지의 편집위원장을 지냈다. 주요 연구 분야는 기계 학습과 컴퓨터 비전, 패턴인식이다. 저서로는 『IT CookBook, 컴퓨터 비전』(한빛아카데미, 2014년, 대한민국학술원 2015년 우수학술도서), 『패턴인식』(교보문고, 2008년, 문화체육관광부 2009년 우수학술도서), 『C 프로그래밍과 스타일링』(교보문고, 2009년), 『컴퓨터 스토리』(교보문고, 2011년), 번역서로는 『앱인벤터2』(한빛아카데미, 2015년)가 있다.

오일석의 다른 상품

관련 분류

품목정보

발행일
2025년 07월 24일
이용안내
  •  배송 없이 구매 후 바로 읽기
  •  다운로드 시점부터 180일 동안 이용 가능
  •   TTS 가능 ?
  •  저작권 보호를 위해 인쇄 기능 제공 안함
지원기기
크레마, PC(윈도우 - 4K 모니터 미지원), 아이폰, 아이패드, 안드로이드폰, 안드로이드패드
파일/용량
PDF(DRM) | 16.73MB ?
ISBN13
9791173409653
KC인증

리뷰/한줄평0

리뷰

첫번째 리뷰어가 되어주세요.

한줄평

첫번째 한줄평을 남겨주세요.