이미지 검색을 사용해 보세요
검색창 이전화면 이전화면
최근 검색어
인기 검색어

소득공제 분철
프로그래머를 위한 강화학습
강화학습 기초부터 대표 알고리즘의 원리와 코드 구현 및 튜닝까지
가격
25,000
10 22,500
YES포인트?
1,250원 (5%)
5만원 이상 구매 시 2천원 추가 적립
결제혜택
카드/간편결제 혜택을 확인하세요
  • 본 도서의 개정판이 출간되었습니다.

이미 소장하고 있다면 판매해 보세요.

  •  국내배송만 가능
  •  분철옵션 선택 시, 배송일이 변경될 수 있습니다.
  •  분철상품은 해외배송이 불가합니다.
  •  문화비소득공제 가능

이 분야의 이벤트

이 상품의 태그

  • 완자 고등 통합과학 2 (2026년용)
    완자 고등 통합과학 2 (2026년용)
    10% 16,650
    상품명 이동
  • EBS 수능완성 영어영역 영어 (2026년)
    EBS 수능완성 영어영역 영어 (2026년)
    10% 14,040
    상품명 이동
  • 2027 유휘운 행정법총론 요약노트+기출문제 (요.플.)
    2027 유휘운 행정법총론 요약노트+기출문제 (요.플.)
    10% 33,300
    상품명 이동
  • EBS 수능완성 국어영역 독서·문학·화법과 작문 (2026년)
    EBS 수능완성 국어영역 독서·문학·화법과 작문 (2026년)
    10% 14,040
    상품명 이동
  • EBS 윤혜정의 개념의 나비효과 입문 편 1권 문학 (2026년용)
    EBS 윤혜정의 개념의 나비효과 입문 편 1권 문학 (2026년용)
    10% 15,300
    상품명 이동
  • 완자 고등 물질과 에너지 (2026년)
    완자 고등 물질과 에너지 (2026년)
    10% 18,000
    상품명 이동
  • 2027 공단기 소방단기 써니 행정법총론 기본서
    2027 공단기 소방단기 써니 행정법총론 기본서
    10% 39,600
    상품명 이동
  • 2026 큰별쌤 최태성의 별별한국사 한국사능력검정시험 심화(1,2,3급) 상
    2026 큰별쌤 최태성의 별별한국사 한국사능력검정시험 심화(1,2,3급) 상
    10% 17,100
    상품명 이동
  • 2026 큰별쌤 최태성의 별별한국사 한국사능력검정시험 심화(1,2,3급) 하
    2026 큰별쌤 최태성의 별별한국사 한국사능력검정시험 심화(1,2,3급) 하
    10% 16,650
    상품명 이동
  • 오투 중학 과학 2-2 (2026년)
    오투 중학 과학 2-2 (2026년)
    10% 17,550
    상품명 이동
  • 2026 큰별쌤 최태성의 별별한국사 기출 500제 한국사능력검정시험 심화(1,2,3급)
    2026 큰별쌤 최태성의 별별한국사 기출 500제 한국사능력검정시험 심화(1,2,3급)
    10% 19,800
    상품명 이동
  • 개념원리 공통수학 2 (2026년용)
    개념원리 공통수학 2 (2026년용)
    10% 17,100
    상품명 이동
  • 완자 고등 역학과 에너지 (2026년)
    완자 고등 역학과 에너지 (2026년)
    10% 18,000
    상품명 이동
  • 쎈 중등 수학 2-2 (2026년)
    쎈 중등 수학 2-2 (2026년)
    10% 17,100
    상품명 이동
  • 완자 고등 세포와 물질대사 (2026년)
    완자 고등 세포와 물질대사 (2026년)
    10% 18,000
    상품명 이동
  • 예비 매3비 매일 지문 3개씩 공부하는 비문학 독서 기출
    예비 매3비 매일 지문 3개씩 공부하는 비문학 독서 기출
    10% 17,100
    상품명 이동
  • EBS 수능완성 사회탐구영역 사회·문화 (2026년)
    EBS 수능완성 사회탐구영역 사회·문화 (2026년)
    10% 8,820
    상품명 이동
  • ETS 토익 정기시험 기출문제집 1000 Vol. 5 RC
    ETS 토익 정기시험 기출문제집 1000 Vol. 5 RC
    10% 19,800
    상품명 이동
  • EBS 수능완성 국어영역 독서·문학·언어와 매체 (2026년)
    EBS 수능완성 국어영역 독서·문학·언어와 매체 (2026년)
    10% 14,040
    상품명 이동
  • 쎈 고등 공통수학2 (2026년)
    쎈 고등 공통수학2 (2026년)
    10% 17,550
    상품명 이동

상세 이미지

책소개

목차

시작하며

01장 강화학습 기본 개념

1.1 강화학습이란
1.2 확률과 확률 과정
1.3. 마르코프 연쇄
1.4 마르코프 보상 과정

02장 강화학습 기본 알고리즘

2.1 마르코프 결정 과정
2.2 MDP 행동 가치 함수
2.3 MDP 최적 가치 함수
2.4 강화학습에 사용되는 다양한 용어
2.5 다이내믹 프로그래밍
2.6 몬테카를로 방법
2.7 TD와 SARSA
2.8 Q 러닝

03장 인공지능의 개념

3.1 머신러닝
3.2 선형 회귀 분석
3.3 분류 분석
3.4 딥러닝
3.5 개발 환경 설치
3.6 텐서플로우

04장 함수 근사법

4.1 미분
4.2 편미분
4.3 스칼라와 벡터
4.4 그래디언트
4.5 경사하강법
4.6 확률적 경사하강법
4.7 강화학습에서 편미분과 경사하강법의 표기법
4.8 함수 근사법

05장 가치 기반 강화학습과 DQN 알고리즘

5.1 DQN 알고리즘
5.2 카트폴
5.3 탐험과 탐욕의 문제
5.4 DQN 알고리즘 기본 구조
5.5 DQN 알고리즘 전체 코드 리뷰
5.6 DQN 알고리즘 세부 구조 살펴보기
5.7 DQN 알고리즘 학습 결과 분석

06장 정책 기반 강화학습 REINFORCE 알고리즘

6.1 인공신경망 다시 보기
6.2 정책 그래디언트
6.3 REINFORCE 알고리즘 동작 방식
6.4 REINFORCE 알고리즘 기본 구조
6.5 REINFORCE 알고리즘 전체 코드 리뷰
6.6 REINFORCE 알고리즘 세부 구조 살펴보기
6.7 REINFORCE 알고리즘 학습 결과 분석

07장 정책 기반 A2C 알고리즘

7.1 액터 크리틱 알고리즘
7.2 어드밴티지 액터 크리틱
7.3 A2C 알고리즘 기본 구조
7.4 A2C 알고리즘 전체 코드 리뷰
7.5 A2C 알고리즘 세부 구조 살펴보기
7.6 A2C 알고리즘 학습 결과 분석

08장 정책 기반 PPO 알고리즘

8.1 중요도 샘플링
8.2 오프 폴리시 정책 그래디언트
8.3 클리핑 기법
8.4 GAE
8.5 PPO 알고리즘 기본 구조
8.6 PPO 알고리즘 전체 코드 리뷰
8.7 PPO 알고리즘 세부 구조 살펴보기
8.8 PPO 알고리즘 알고리즘 학습 결과 분석

09장 인공신경망 튜닝

9.1 인공신경망 튜닝 개요
9.2 입력 데이터 전처리
9.3 비용 함수의 선택
9.4 활성화 알고리즘
9.5 가중치 초기화
9.6 최적화 알고리즘
9.7 노드와 은닉층 개수에 대한 논의
9.8 PPO 알고리즘 인공신경망 튜닝
9.9 PPO 알고리즘 튜닝 코드 적용
9.10 PPO 알고리즘 튜닝 결과 분석

10장 그리드 서치 기반 최적화 기법

10.1 그리드 서치 개념
10.2 그리드 서치 코딩
10.3 그리드 서치 전체 코드
10.4 그리드 서치 결과 분석
10.5 그리드 서치 파라미터 튜닝 적용

11장 베이지안 최적화 기법

11.1 빈도주의 확률과 베이지안 확률
11.2 베이지안 확률 계산
11.3 베이지안 최적화 패키지 소개
11.4 베이지안 최적화 패키지 활용
11.5 베이지안 최적화 전체 코드
11.6 베이지안 최적화 결과 분석

마무리하며
찾아보기

저자 소개 3

멀티코어

관심작가 알림신청
 
프로그래머이자 인공지능 전문가이다. 프로그래머로서 다양한 분야에서 활동했으며 현재는 기업에서 데이터분석과 강화학습을 활용한 비즈니스 환경 개선 업무를 담당하고 있다. 인공지능이 학위를 받은 소수의 전문가만을 위한 영역이 아니라 프로그래머도 충분히 도전할 수 있음을 후배들에게 보여주기 위해 부단히 노력하고 있다.

멀티코어의 다른 상품

김남준(nanamjk@naver.com)은 프로그램 개발자이자 데이터 전문가. 인공지능 학습 데이터와 데이터 보안을 담당하고 있다. 최근에는 공학용 데이터 분석을 위한 알고리즘 연구와 시각화를 진행하고 있다.

김남준의 다른 상품

인공지능 및 정보시스템 전문가이다. 인공지능 어플리케이션 개발 업무를 담당하고 있으며, 서울디지털대학교와 동국대 국제정보대학원 및 다수의 대학에서 관련 강의를 하고 있다. 최신 인공지능 기술의 저변 확대를 위해 클라우드 환경에서 쉽게 활용 가능한 인공지능과 도메인별 LLM기반 Agent 적용에 많은 고민을 하고 있다.

윤철희의 다른 상품

품목정보

발행일
2021년 03월 31일
쪽수, 무게, 크기
336쪽 | 182*232*30mm
ISBN13
9788965402930

출판사 리뷰

인공지능의 최전선, 강화학습

이제 인공지능은 IT 업계를 넘어 다양한 분야와 비즈니스로 활용 폭을 넓히고 있습니다. 인공지능을 공부하다 보면 머신러닝과 딥러닝부터 시작해서 결국에는 강화학습을 마주하게 됩니다. 강화학습은 시행착오를 거쳐 해결책을 찾아나가는 기법으로, 인공지능 기술 중에서 가장 난이도가 높습니다. 그래서 원리를 이해하려면 상당한 수준의 수학과 통계 이론을 알아야 합니다.

이 책에서는 강화학습의 기초가 되는 수식을 하나하나 자세히 유도하기보다는 수식이 이어지는 흐름을 따라가면서 다양한 알고리즘의 원리를 한눈에 살펴보고, 코드로 구현해가며 활용법을 익히도록 구성했습니다. 이 책을 출발점으로 삼아, 인공지능의 최전선에 있는 강화학습을 제대로 이해하고 활용할 수 있는 발판을 마련해 봅시다.

이 책의 특징

· 강화학습 이해에 필요한 통계와 수학 이론을 기초부터 다룬다.
· 알고리즘의 기본 개념을 그림으로 표현하여 이해를 돕는다.
· 하나의 예제를 통해 일관성 있게 개념과 이론을 설명해 나간다.
· 파이썬 코드 구현과 튜닝, 최적화까지 실무에 적용할 수 있는 수준까지 다룬다.

이 책의 구성

이 책은 강화학습의 기초 개념과 인공지능 개념, 가치 기반 강화학습, 정책 기반 강화학습, 튜닝 문제, 이렇게 모두 다섯 부분으로 구성됩니다.

· 강화학습의 기초 개념: 강화학습에 필요한 통계 및 수학 이론과 MDP에 대한 설명
· 인공지능 개념: 머신러닝부터 강화학습 내부에서 사용하는 인공신경망으로 이르는 과정을 선형 회귀부터 차근차근 설명
· 가치 기반 강화학습: 상대적으로 이해하기 쉬운 DQN 알고리즘을 코드 중심으로 설명
· 정책 기반 강화학습: REINFORCE, A2C, PPO 알고리즘에 대한 설명과 실행 안내
· 튜닝 문제: 알고리즘의 파라미터 튜닝을 효율적으로 돕는 그리드 서치와 베이지안 최적화 기법

리뷰/한줄평8

리뷰

8.6 리뷰 총점

한줄평

9.6 한줄평 총점

클린봇이 부적절한 글을 감지 중입니다.

설정