알파제로를 분석하며 배우는 인공지능 : 북윈도
리뷰 0 위시 120

알파제로를 분석하며 배우는 인공지능 요약정보 및 구매

딥 러닝, 강화 학습, 탐색으로 배우는 인공지능 프로그래밍

상품 선택옵션 0 개, 추가옵션 0 개

출판사 제이펍
저자 후루카와 히데카즈
ISBN 9791188621804 (1188621807)
정가 30,000원
판매가 27,000원(10% 할인)
배송비 무료배송
포인트 정책 설명문 닫기

00포인트

포인트 정책 설명문 출력

선택된 옵션

관심상품

상품 정보

사은품
상품 기본설명
딥 러닝, 강화 학습, 탐색으로 배우는 인공지능 프로그래밍
상품 상세설명
알파제로를 실제로 만들어 보면서 배우는 인공지능!

이 책은 프로 바둑 기사들에게 승리를 거둔 인공지능 알파고의 최신 버전인 알파제로를 실제로 만들어 보면서 학습하는 인공지능 프로그래밍 입문서입니다. 작은 프로그램을 단계별로 작성하면서 프로그래밍 언어인 파이썬과 인공지능 기초 기술인 딥 러닝, 강화 학습, 탐색을 학습하고, 최종으로 알파제로 기반의 인공지능을 완성해 틱택토, 커넥트4, 오셀로, 간이 장기 게임 등을 실습해 봅니다.





목차
CHAPTER 1 알파제로와 머신러닝 개요 1
1-1 알파고와 알파고 제로, 그리고 알파제로 3
1-2 딥 러닝 개요 7
1-3 강화 학습 개요 18
1-4 탐색 개요 23

CHAPTER 2 파이썬 개발 환경 준비 27
2-1 파이썬과 Google Colab 개요 29
2-2 Google Colab 사용 방법 34
2-3 파이썬 문법 47

CHAPTER 3 딥 러닝 63
3-1 뉴럴 네트워크를 활용한 분류 65
3-2 뉴럴 네트워크를 활용한 회귀 83
3-3 컨볼루셔널 뉴럴 네트워크를 활용한 이미지 분류 93
3-4 ResNet을 활용한 이미지 분류 107

CHAPTER 4 강화 학습 125
4-1 다중 슬롯머신 문제 127
4-2 정책 경사법을 활용한 미로 게임 138
4-3 Sarsa와 Q 학습을 활용한 미로 게임 151
4-4 DQN을 활용한 카트-폴 165

CHAPTER 5 탐색 187
5-1 미니맥스법을 활용한 틱택토 189
5-2 알파베타법을 활용한 틱택토 199
5-3 원시 몬테카를로 탐색을 활용한 틱택토 205
5-4 몬테카를로 트리 탐색을 활용한 틱택토 210

CHAPTER 6 알파제로의 구조 223
6-1 알파제로를 활용한 틱택토 225
6-2 듀얼 네트워크 생성 232
6-3 몬테카를로 트리 탐색 구현 241
6-4 셀프 플레이 파트 구현 252
6-5 파라미터 갱신 파트 구현 257
6-6 신규 파라미터 평가 파트 구현 263
6-7 베스트 플레이어 평가 268
6-8 학습 사이클 실행 273

CHAPTER 7 사람과 AI의 대전 279
7-1 로컬 파이썬 개발 환경 준비 281
7-2 Tkinter를 활용한 GUI 구현 292
7-3 사람과 AI의 대전 302

CHAPTER 8 샘플 게임 구현 309
8-1 커넥트4 311
8-2 오셀로 326
8-3 간이 장기 344

찾아보기 371
책속으로
알파고 제로를 발표한지 48일이 지난 2017년 12월, 딥마인드는 알파고 제로를 한층 개량한 알파제로를 선보였다. 알파제로는 바둑뿐만 아니라, 체스나 장기까지 학습할 수 있었으며, 당시 바둑, 체스, 장기 부문에서 게임 AI 세계 챔피언이었던 알파고 제로, 스톡피쉬, 엘모에 승리를 거두었다.
_5페이지활성화 함수는 주로 전결합 레이어 다음에 적용하는 함수다. 레이어의 출력을 특정한 함수에 통과시킨 뒤, 최종 출력값을 결정한다. 활성화 함수를 사용하면 선형적으로 분류할 수 없는 데이터도 분류할 수 있기 때문에 보다 복잡한 특징을 잡아낼 수 있다. 선형적으로 분류할 수 없는 데이터란 일직선으로 분리할 수 없는 데이터를 의미한다.
_71페이지정책에 따라 행동하면서 성공 시의 행동은 중요한 것으로 판단하고, 그 행동을 많이 할 수 있도록 정책을 갱신하는 방법을 ‘정책 경사법’이라고 부른다. 이번에는 정책 경사법을 활용해 미로 게임을 공략한다. 에이전트가 상하좌우로 이동해 골인 지점(우측 하단)까지 도착하는 것이 목적이다.
_138페이지ResNet과 같은 컨볼루셔널 뉴럴 네트워크는 이미지 인식 분야에서 보다 높은 성능을 발휘하는 뉴럴 네트워크다. 알파제로에서는 이 뉴럴 네트워크의 입력으로 이미지가 아닌 게임의 보드면을 사용한다. 이미지와 게임의 보드면은 모두 가로세로 방향의 정보 나열에 의미가 있으므로 컨볼루셔널 뉴럴 네트워크를 활용해 특징을 추출하기에 적합하다.
_232페이지두 사람이 대전하는 보드 게임인 ‘오셀로’를 구현한다. 교대로 6×6의 보드면에 돌을 놓고, 상대의 돌을 포위하면 자신의 돌의 색깔로 바꾼다. 마지막에 돌이 많은 쪽이 승리한다. 둘수 있는 수가 없는 경우에는 자동적으로 패스가 되며(순서가 상대방에게 넘어감), 연속으로 패스하면 게임이 종료된다. ‘오셀로 UI’에서는 클릭으로 돌을 배치한다. 또한, 간소화한 버전이기 때문에 사람이 항상 선 수를 둔다.
_326페이지
출판사 서평
알파제로를 실제로 만들어 보면서 배우는 인공지능!
Google Colaboratory 기반의 손쉬운 테스트 환경!이 책은 프로 바둑 기사들에게 승리를 거둔 인공지능 알파고의 최신 버전인 알파제로를 실제로 만들어 보면서 학습하는 인공지능 프로그래밍 입문서다. 작은 프로그램을 단계별로 작성하면서 프로그래밍 언어인 파이썬과 인공지능 기초 기술인 딥 러닝, 강화 학습, 탐색을 학습하고, 최종으로 알파제로 기반의 인공지능을 완성해 틱택토, 커넥트4, 오셀로, 간이 장기 게임 등을 실습해 본다.인공지능 프로그래밍이라고 하면 고성능 컴퓨터나 서버가 필요할 것 같지만, 이 책에서는 구글이 제공하는 무료 온라인 서비스인 ‘Google Colaboratory’를 사용하기 때문에 고급 장비는 필요하지 않다. 웹 브라우저를 사용할 수 있는 개인용 컴퓨터(윈도우/맥/리눅스)와 네트워크 환경만 있으면 누구나 손쉽고 간단하게 인공지능 프로그래밍을 시작할 수 있다. 부디 이 책이 인공지능 프로그래밍을 시작하고 싶은 분에게 도움이 되고, 더 많은 독자가 알파제로 알고리즘의 우아함을 느낄 수 있길 바란다.이 책에서 다루는 알파제로 관련 이론
■ 딥러닝: 컨볼루셔널 뉴럴 네트워크, ResNet
■ 강화 학습: 다중 슬롯 머신 문제, 경사 하강법, Sarsa, Q 학습, DQN
■ 탐색: 미니맥스법, 알파베타법, 원시 몬테카를로 탐색, 몬테카를로 트리 탐색
상품 정보 고시
도서명 알파제로를 분석하며 배우는 인공지능
저자 후루카와 히데카즈
출판사 제이펍
ISBN 9791188621804 (1188621807)
쪽수 396
출간일 2019-12-30
사이즈 188 * 245 * 17 mm
목차 또는 책소개 CHAPTER 1 알파제로와 머신러닝 개요 1
1-1 알파고와 알파고 제로, 그리고 알파제로 3
1-2 딥 러닝 개요 7
1-3 강화 학습 개요 18
1-4 탐색 개요 23

CHAPTER 2 파이썬 개발 환경 준비 27
2-1 파이썬과 Google Colab 개요 29
2-2 Google Colab 사용 방법 34
2-3 파이썬 문법 47

CHAPTER 3 딥 러닝 63
3-1 뉴럴 네트워크를 활용한 분류 65
3-2 뉴럴 네트워크를 활용한 회귀 83
3-3 컨볼루셔널 뉴럴 네트워크를 활용한 이미지 분류 93
3-4 ResNet을 활용한 이미지 분류 107

CHAPTER 4 강화 학습 125
4-1 다중 슬롯머신 문제 127
4-2 정책 경사법을 활용한 미로 게임 138
4-3 Sarsa와 Q 학습을 활용한 미로 게임 151
4-4 DQN을 활용한 카트-폴 165

CHAPTER 5 탐색 187
5-1 미니맥스법을 활용한 틱택토 189
5-2 알파베타법을 활용한 틱택토 199
5-3 원시 몬테카를로 탐색을 활용한 틱택토 205
5-4 몬테카를로 트리 탐색을 활용한 틱택토 210

CHAPTER 6 알파제로의 구조 223
6-1 알파제로를 활용한 틱택토 225
6-2 듀얼 네트워크 생성 232
6-3 몬테카를로 트리 탐색 구현 241
6-4 셀프 플레이 파트 구현 252
6-5 파라미터 갱신 파트 구현 257
6-6 신규 파라미터 평가 파트 구현 263
6-7 베스트 플레이어 평가 268
6-8 학습 사이클 실행 273

CHAPTER 7 사람과 AI의 대전 279
7-1 로컬 파이썬 개발 환경 준비 281
7-2 Tkinter를 활용한 GUI 구현 292
7-3 사람과 AI의 대전 302

CHAPTER 8 샘플 게임 구현 309
8-1 커넥트4 311
8-2 오셀로 326
8-3 간이 장기 344

찾아보기 371
배송공지

사용후기

회원리뷰 총 0개

사용후기가 없습니다.

상품문의

등록된 상품문의

상품문의 총 0개

상품문의가 없습니다.

교환/반품

[반품/교환방법]
마이페이지> 주문배송조회 > 반품/교환신청 또는 고객센터 (070-4680-5689)로 문의 바랍니다.

[반품주소]
- 도로명 : (10882) 경기도 파주시 산남로 62-20 (산남동)
- 지번 : (10882) 경기도 파주시 산남동 305-21

[반품/교환가능 기간]
변심반품의 경우 수령 후 14일 이내, 상품의 결함 및 계약내용과 다를 경우 문제점 발견 후 30일 이내

[반품/교환비용]
단순 변심 혹은 구매착오로 인한 반품/교환은 반송료 고객 부담

[반품/교환 불가 사유]
- 소비자의 책임 있는 사유로 상품 등이 손실 또는 훼손된 경우
(단지 확인을 위한 포장 훼손은 제외)
- 소비자의 사용, 포장 개봉에 의해 상품 등의 가치가 현저히 감소한 경우
예) 화장품, 식품, 가전제품(악세서리 포함) 등
- 복제가 가능한 상품 등의 포장을 훼손한 경우
예) 음반/DVD/비디오, 소프트웨어, 만화책, 잡지, 영상 화보집
- 소비자의 요청에 따라 개별적으로 주문 제작되는 상품의 경우 ((1)해외주문도서)
- 디지털 컨텐츠인 eBook, 오디오북 등을 1회 이상 다운로드를 받았을 경우
- 시간의 경과에 의해 재판매가 곤란한 정도로 가치가 현저히 감소한 경우
- 전자상거래 등에서의 소비자보호에 관한 법률이 정하는 소비자 청약철회 제한 내용에 해당되는 경우
* (1) 해외주문도서 : 이용자의 요청에 의한 개인주문상품으로 단순변심 및 착오로 인한 취소/교환/반품 시
‘해외주문 반품/취소 수수료’ 고객 부담 (해외주문 반품/취소 수수료 : ①양서-판매정가의 12%, ②일서-판매정가의 7%를 적용)

[상품 품절]
공급사(출판사) 재고 사정에 의해 품절/지연될 수 있으며, 품절 시 관련 사항에 대해서는 이메일과 문자로 안내드리겠습니다.

[소비자 피해보상, 환불지연에 따른 배상]
- 상품의 불량에 의한 교환, A/S, 환불, 품질보증 및 피해보상 등에 관한 사항은 소비자분쟁해결 기준 (공정거래위원회 고시)에 준하여 처리됩니다.
- 대금 환불 및 환불지연에 따른 배상금 지급 조건, 절차 등은 전자상거래 등에서의 소비자 보호에 관한 법률에 따라 처리함.

회원로그인

오늘 본 상품

  • 알파제로를 분석하며 배우는 인공지능
    알파제로를 분석하며
    27,000
  • 너도 만들 수 있어! 유니티 모바일 게임
    너도 만들 수 있어
    34,200
  • 나를 포함한 누구나의 아픔이 될 치매, 쉽게 알고 대응하기
    나를 포함한 누구나
    16,200
  • 가상 면접 사례로 배우는 대규모 시스템 설계 기초
    가상 면접 사례로
    21,600
  • [출간예정] 신경써달라고 한 적 없는데요?
    [출간예정] 신경써
    15,300
  • 논어: 사기 공자세가 논어 다시 태어나다
    논어: 사기 공자세
    19,800
  • 17년째 버티고 있는 중입니다
    17년째 버티고 있
    11,520
  • Do it! 건축 BIM을 위한 Revit 입문
    Do it! 건축
    19,800
  • 숲 유치원
    숲 유치원
    16,200
  • 문과생, 데이터 사이언티스트 되다
    문과생, 데이터 사
    13,500
  • 딥러닝을 위한 최적화와 수치해석
    딥러닝을 위한 최적
    28,800
  • 나는 생각하고 말하는 사람이 되기로 했다
    나는 생각하고 말하
    12,150
  • 스무 살, 안경 대신 라섹을 하기로 했습니다
    스무 살, 안경 대
    14,220
  • 허클베리 핀의 모험
    허클베리 핀의 모험
    9,900
  • 1초 만에 잠드는 방법
    1초 만에 잠드는
    13,500
  • 무엇을 도와드릴까요? 수학가게입니다
    무엇을 도와드릴까요
    11,700
  • 다이어트 절대법칙
    다이어트 절대법칙
    12,870
  • 나는 독일에서 일한다
    나는 독일에서 일한
    13,500
  • Django 한 그릇 뚝딱
    Django 한 그
    25,200
  • 살집팔집
    살집팔집
    25,200
  • ESG 파이코노믹스
    ESG 파이코노믹스
    16,200
  • 바쁜 사람은 단순하게 운동합니다
    바쁜 사람은 단순하
    11,700
  • 클라우드 핀옵스
    클라우드 핀옵스
    23,400
  • [출간예정] 회사에서 바로 통하는 오토캐드 AutoCAD 2022
    [출간예정] 회사에
    25,200
  • 파킨슨병 이렇게 하면 낫는다
    파킨슨병 이렇게 하
    10,800
  • 엘리베이터에 낀 그 남자는 어떻게 되었나 / 김영하
    엘리베이터에 낀 그
    9,000
  • 자바스크립트 코딩의 기술
    자바스크립트 코딩의
    21,600