Name: 파이썬 기반 강화학습 알고리듬
Author: 안드레아 론자 저/정사범 역

YES24 카테고리 리스트

YES24 유틸메뉴

Global YES24안내보기: Global YES24는?

K-POP/K-Drama 관련상품(음반,도서,DVD)을
영문/중문 으로 이용하실 수 있습니다.

Korean wave shopping mall, sell the
K-POP/K-Drama (CD,DVD,Blu-ray,Book) We aceept PayPal/UnionPay/Alipay
and support English/Chinese Language service
English
作为出售正规 K-POP/K-Drama 相关(CD,图书,DVD) 韩流商品的网站, 支持中文/英文等海外结账方式
中文
Exclusive ticket sales for domestic and international pop artists
Global yesticket

어깨배너

1/6

빠른분야찾기

YES24 코너/서비스

YES24 분야별코너

신용카드 (54x86mm)

A4용지 (210x297mm)

미리보기 사이즈비교 공유하기

소득공제 에이콘 데이터 과학 시리즈

파이썬 기반 강화학습 알고리듬

DP, Q-Learning, AC, DQN, TRPO, PPO, DDPG, TD3, Imitation Learning, ESBAS 알아보기

안드레아 론자 저/정사범 역 | 에이콘출판사 | 2021년 08월 25일 | 원서 : Reinforcement Learning Algorithms with Python: Learn, understand, and develop smart algorithms for addressing AI challenges 첫번째 리뷰어가 되어주세요. | 판매지수 102 판매지수란?

상품 가격정보
정가	30,000원
판매가	27,000원 (10% 할인)
YES포인트	1,500원 (5% 적립) 5만원이상 구매 시 2천원 추가적립 5만원이상 구매 시 2천원 추가적립 안내

결제혜택
결제혜택	카드/간편결제 혜택을 확인하세요 카드/간편결제 혜택 보기/감추기 예스24 현대카드 2만원 캐시백 이벤트 [기본혜택] YES포인트 1~3% 적립 관련페이지 바로가기 카카오페이 3,000원 즉시할인 일 선착순 500건, 5만원 이상 관련페이지 바로가기 네이버페이 5천 포인트 적립 1천명 추첨, 5만원 이상 관련페이지 바로가기 모바일팝 모바일 6% 즉시할인 모바일 결제시 관련페이지 바로가기 토스페이 첫결제 2천P 지급 생애첫결제시 관련페이지 바로가기

배송안내
배송안내 바로가기

배송비 : 무료 배송비 안내

구매 시 참고사항
구매 시 참고사항

이미 소장하고 있다면 2,100원에 판매해 보세요!이 상품을 팔기더보기/감추기
- 예스24에 팔기
  최상매입가 2,100원
- 내 가게에서 팔기

판매중

수량

카트에 넣기 바로구매

국내배송만 가능
최저가 보상
문화비소득공제 신청가능

리스트에 넣기 eBook 출간 알림신청 분철서비스 알림신청

월간개발자 7월호이동

신입/경력 개발자 이직 기획전이동

공부합시다! 생성형 AI이동

7월의 굿즈 : 3단우산&메쉬가방이동

이전 YES NOW 배너보기

다음 YES NOW 배너보기

1/4

광고 AD

파이썬 기반 강화학습 알고리듬

카트에 넣기 바로구매

품목정보

품목정보
발행일	2021년 08월 25일
쪽수, 무게, 크기	448쪽 \| 18823530mm
ISBN13	9791161755571
ISBN10	1161755578

이 상품의 이벤트 (7개)

2024 한국 문학의 미래가 될 젊은 작가에 투표하세요!

2024년 06월 17일 ~ 2024년 07월 14일
실력있는 개발자를 위한 프로그래밍 전문서 : 한빛미디어 오라일리 시리즈

소진시
정가 인하 & 특가 할인 도서 모음

상시
YES24 트윈링 분철 : 인서트라벨/스티커 택1 증정

소진시
얼리리더를 위한 7월의 책 : 곰돌이 푸_마그넷 오프너 증정

2024년 07월 01일 ~ 2024년 07월 31일
[2024 상반기 결산] 베스트셀러 TREND 5

2024년 06월 10일 ~ 2024년 07월 10일
오직, 예스24에서만

상시

펼쳐보기접어보기

책소개

책의 일부 내용을 미리 읽어보실 수 있습니다. 미리보기

1부. 알고리듬과 환경 1장. 강화학습의 개요 __강화학습 소개 ______강화학습과 지도학습의 비교 ____강화학습의 역사 ____딥 강화학습 __강화학습의 구성 요소 ____폴리시 ____가치함수 ____보상 ____모델 __강화학습 애플리케이션 ____게임 ____로봇과 인더스트리 4.0 ____기계학습 ____경제와 금융 ____헬스케어 ____지능형 교통시스템 ____에너지 최적화와 스마트 그리드 __요약 __질문 __심화학습 자료 2장. 강화학습 사이클과 OpenAI Gym 구현하기 __환경 설정하기 ____OpenAI Gym 설치하기 ____로보스쿨 설치하기 __OpenAI Gym과 강화학습 사이클 ____강화학습 사이클 개발하기 ____공간에 익숙해지기 ____텐서플로우 2.X ________즉시 실행 ________오토그래프 __텐서플로우 기반 기계학습 모델 개발 ____텐서 ________상수 ________변수 ________그래프 생성하기 ____간단한 선형회귀 예제 ____텐서보드 도입하기 __강화학습 환경의 유형 ____왜 다른 환경인가? ____오픈소스 환경 __요약 __질문 __심화학습 자료 3장. 동적 프로그래밍DP으로 문제 해결하기 __MDP ____폴리시 ____감가율과 리턴 ____가치함수 ____벨만 방정식 __강화학습 알고리듬 분류 ____모델 프리 알고리듬 ________가치 기반 알고리듬 ________폴리시 그래디언트 알고리듬 ________액터 크리틱 알고리듬 ________하이브리드 알고리듬 ____모델 기반 강화학습 ____알고리듬 다양화 __DP ____폴리시 평가와 폴리시 개선 ____폴리시 이터레이션 ________프로즌레이크에 적용된 폴리시 이터레이션 ____가치 이터레이션 ________프로즌레이크에 적용한 가치 이터레이션 __요약 __질문 __심화학습 자료 2부. 모델 프리 강화학습 알고리듬 4장. Q-러닝과 SARSA 애플리케이션 __모델없이 학습하기 ____사용자 경험 ____폴리시 평가 ____탐색 문제 ________왜 탐색해야 하는가? ________탐색 방법 __시간차 학습 ____시간차 업데이트 ____폴리시 개선 ____몬테카를로와 시간차 비교 __SARSA ____알고리듬 __Taxi-v2에 SARSA 적용하기 __Q-러닝 ____이론 ____알고리듬 __Taxi-v2에 Q-러닝 적용하기 ____SARSA와 Q-러닝 비교 __요약 __질문 5장. Deep Q-Network __심층신경망과 Q-러닝 ____함수 근사 ____신경망을 이용한 Q-러닝 ____딥 Q-러닝의 불안정성 __DQN ____해결책 ________리플레이 메모리 ________타깃 네트워크 ____DQN 알고리듬 ________손실함수 ________의사코드 ____모델 아키텍처 __DQN을 퐁에 적용하기 ____아타리 게임 ____전 처리 ____DQN 구현 ________DNN ________경험 버퍼 ________계산 그래프와 훈련 루프 ____결과 __DQN 개선 알고리듬 ____Double DQN ________DDQN 구현 ________결과 ____DQN 듀얼링하기 ________듀얼링 DQN 구현 ________결과 ____N-스텝 DQN ________구현 ________결과 __요약 __질문 __심화학습 자료 6장. 확률 기반 PG 최적화 학습 __폴리시 그래디언트 메소드 ____폴리시의 그래디언트 ____폴리시 그래디언트 정리 ____그래디언트 계산하기 ____폴리시 ____온-폴리시 PG __REINFORCE 알고리듬 이해하기 ____REINFORCE 구현하기 ____REINFORCE를 이용해 탐사선 착륙시키기 ________결과 분석하기 __베이스라인이 있는 REINFORCE ____베이스라인으로 REINFORCE 구현하기 __AC 알고리듬 학습하기 ____액터가 학습하도록 돕기 위해 크리틱 사용하기 ____n-step AC 모델 ____AC 구현 ____AC를 사용해 탐사선spacecraft 착륙시키기 ____고급 AC 팁과 트릭 __요약 __질문 __심화학습 자료 7장. TRPO와 PPO 구현 __로보스쿨 ____연속 시스템 제어 __Natural Policy Gradient ____NPG에 대한 아이디어 ____수학적 개념 ________FIM과 KL 발산 ____NG 문제 __TRPO ____TRPO 알고리듬 ____TRPO 알고리듬 구현 ____TRPO 애플리케이션 __Proximal Policy Optimization ____PPO의 개요 ____PPO 알고리듬 ____PPO의 구현 ____PPO 애플리케이션 __요약 __질문 __심화학습 자료 8장. DDPG와 TD3 애플리케이션 __폴리시 그래디언트 최적화와 Q-러닝 결합하기 ____결정론적 폴리시 그래디언트 ____DDPG 알고리듬 ____DDPG 구현 ____DDPG를 BipedalWalker-v2에 적용하기 __TD3 폴리시 그래디언트 ____과대평가 편향 문제 해결 ________TD3의 구현 ____분산 감소 해결 ________지연된 폴리시 업데이트 ________타깃 정규화 ____BipedalWalker에 TD3를 적용하기 __요약 __질문 __심화학습 자료 3부. 모델 프리 알고리듬과 개선 9장. 모델 기반 강화학습 __모델 기반 메소드 ____모델 기반 학습에 대한 폭넓은 관점 ________알려진 모델 ________미지의 모델 ____장단점 __모델 기반 학습과 모델 프리 학습 결합하기 ____모델 기반과 모델 프리 접근법의 유용한 조합 ____이미지에서 모델 만들기 __역진자에 적용한 ME-TRPO 모델 ____ME-TRPO 이해하기 ____ME-TRPO 구현하기 ____로보스쿨 실험하기 ________로보스쿨 역진자 실험 결과 __요약 __질문 __심화학습 자료 10장. DAgger 알고리듬으로 모방 학습하기 __기술적 요구 사항 ____Flappy Bird 설치 __모방 접근 ____운전 보조 사례 ____IL과 RL 비교하기 ____모방 학습에서 전문가의 역할 ____IL 구조 ________수동 모방과 능동 모방 비교하기 __Flappy Bird 게임하기 ____환경을 이용하는 방법 __데이터 집합dataset 집계 알고리듬 이해하기 ____DAgger 알고리듬 ____DAgger의 구현 ________전문가 추론 모델 적재 ________학습자의 계산 그래프 만들기 ________DAgger loop 만들기 ____Flappy Bird 결과 분석 __IRL __요약 __질문 __심화학습 자료 11장. 블랙박스 최적화 알고리듬 이해하기 __강화학습의 대안 ____강화학습에 대한 간단한 요약 ____대안 ________EAs __EA의 핵심 ____유전자 알고리듬GA ____진화 전략 ________CMA-ES ________ES 대 RL __확장 가능한 진화 전략 ____핵심 ________ES 병렬화하기 ________다른 트릭 ________의사 코드 ____확장 가능한 구현 ________메인 함수 ________작업자 __확장 가능한 ES를 LunarLander에 적용하기 __요약 __질문 __심화학습 자료 12장. ESBAS 알고리듬 개발하기 __탐색 대 활용 ____멀티 암드 밴딧 __탐색 접근법 ____탐욕 전략 ____UCB 알고리듬 ________UCB1 ____탐색 복잡도 __ESBAS ____알고리듬 선택 알아보기 ____ESBAS 내부 구조 ____구현 ____Acrobot 실행하기 ________결과 __요약 __질문 __심화학습 자료 13장. 강화학습 문제를 해결하기 위한 실제 구현 __딥 강화학습의 모범 사례 ____적합한 알고리듬 선택하기 ____강화학습 알고리듬 개발하기 __딥 강화학습의 도전 과제 ____안정성과 재현성 ____효율성 ____일반화 __고급 기술 ____비지도 강화학습 ________내재적 보상 ____전이 학습 ________전이 학습의 유형 __현실에서의 강화학습 ____강화학습을 현실에 적용할 때 해결해야 할 문제 ____시뮬레이션과 현실 사이의 차이 줄이기 ____자기만의 환경 만들기 __강화학습의 미래와 사회에 미치는 영향 __요약 __질문 __심화학습 자료

펼쳐보기접어보기

저자 소개 (2명)

저 : 안드레아 론자

관심작가 알림신청 작가 파일

역 : 정사범

관심작가 알림신청 작가 파일

의사 결정과 최적화 방법론에 관심이 많다. 세상에 존재하는 다양한 데이터를 이용해 여러 가지 문제를 해결하는 일을 하고 있다. 다양한 책과 현장 경험을 통해 데이터 수집, 정제, 분석, 보고 방법에 대한 지식을 얻는 것에 감사하고 있다. 에이콘출판사에서 출간한 『RStudio 따라잡기』(2013), 『The R book(Second Edition) 한국어판』(2014), 『예측 분석 모델링 실무 기법』(2014)... 의사 결정과 최적화 방법론에 관심이 많다. 세상에 존재하는 다양한 데이터를 이용해 여러 가지 문제를 해결하는 일을 하고 있다. 다양한 책과 현장 경험을 통해 데이터 수집, 정제, 분석, 보고 방법에 대한 지식을 얻는 것에 감사하고 있다. 에이콘출판사에서 출간한 『RStudio 따라잡기』(2013), 『The R book(Second Edition) 한국어판』(2014), 『예측 분석 모델링 실무 기법』(2014), 『데이터 마이닝 개념과 기법』(2015), 『파이썬으로 풀어보는 수학』(2016), 『데이터 스토리텔링』(2016), 『R에서 객체지향 프로그래밍 사용하기』(2016), 『파이썬 프로그래밍 개론』(2016), 『산업인터넷(IIOT)과 함께하는 인더스트리 4.0』(2017), 『장고 마스터하기』(2017), 『텐서플로로 구현하는 딥러닝과 강화학습』(2017)을 번역했다.

펼쳐보기접어보기

만든 이 코멘트

저자, 역자, 편집자를 위한 공간입니다. 독자들에게 전하고 싶은 말씀을 남겨주세요. 코멘트 쓰기

접수된 글은 확인을 거쳐 이 곳에 게재됩니다.
독자 분들의 리뷰는 리뷰 쓰기를, 책에 대한 문의는 1:1 문의를 이용해 주세요.

출판사 리뷰

* 이 책에서 다루는 내용 - OpenAI Gym 인터페이스를 이용해 카트폴 게임을 하는 에이전트 개발 - 모델 기반 강화학습 패러다임 - 동적 프로그래밍으로 프로즌레이크 문제 해결 - Q-러닝과 SARAS를 이용해 택시 게임 실행 - 딥 Q-러닝(DQN)을 이용해 아타리 게임 실행 - 액터 크리틱과 REINFORCE를 이용해 폴리시 그래디언트 알고리듬 학습 - PPO와 TRPO를 연속형 로코모션 환경에 사용 - 진화 전략을 사용한 달 착륙 문제 해결 * 이 책의 대상 독자 인공지능 엔지니어나 딥러닝 사용자가 강화학습 기초를 배울 때 적합하다. 또한 강화학습 분야의 일부 고급 기술을 알고 싶은 경우에도 유용하다. 다만 책 내용을 이해하려면 파이썬을 활용할 줄 알아야 한다. * 이 책의 구성 1장, ‘강화학습의 개요’에서는 강화학습이 필요한 분야와 강화학습 알고리듬을 이미 적용한 분야를 설명한다. 또한 2장의 프로젝트 실행에 필요한 툴, 라이브러리, 설정(setup)을 설명한다. 2장, ‘강화학습 사이클과 OpenAI Gym 구현’에서는 강화학습 알고리듬의 주요 사이클, 알고리듬 개발에 필요한 툴킷, 다양한 환경 유형을 설명한다. 랜덤 액션을 이용해 카트폴(cartpole)을 플레이하기 위해 OpenAI Gym 인터페이스를 이용한 랜덤 에이전트를 개발할 수 있다. 또한 다른 환경을 실행하기 위해 OpenAI Gym 인터페이스를 사용하는 방법을 학습해본다. 3장, ‘동적 프로그래밍으로 문제 해결하기’에서는 핵심 아이디어, 용어, 강화학습의 접근법을 소개한다. 강화학습의 메인 블록을 학습하고 문제 해결을 위해 강화학습 알고리듬을 만드는 방법의 일반적인 아이디어를 개발한다. 또한 모델 기반과 모델 프리 알고리듬의 차이와 강화학습 알고리듬 분류를 학습할 것이다. 동적 프로그래밍은 프로즌레이크(frozen lake) 게임을 해결하는 데 사용해본다. 4장, ‘Q-러닝과 SARSA 애플리케이션’에서는 가치 기반 메소드, 특히 동적 프로그래밍과 다르며 대규모 문제에 확장 적용이 가능한 Q-러닝과 SARSA를 설명한다. 이 알고리듬을 이해하기 위해 프로즌레이크 게임에 강화학습을 적용하고 동적 프로그래밍과의 차이를 알아본다. 5장, ‘DQN’에서는 특별히 Q-러닝에 적용한 신경망과 컨볼루션 신경망 CNN을 설명한다. Q-러닝과 신경망의 결합이 어떻게 뛰어난 결과를 만들고 많은 문제 해결에 사용될 수 있는지 알게 될 것이다. 추가로 DQN을 OpenAI Gym 인터페이스를 이용한 아타리 게임에 사용해본다. 6장, ‘확률적 PG 최적화 학습’에서는 새로운 모델 프리 알고리듬군(폴리시 그래디언트 메소드)을 소개한다. 그리고 폴리시 그래디언트와 가치 기반 메소드의 차이점과 장단점을 학습한다. 다음으로 REINFORCE와 액터 크리틱 알고리듬을 구현해 달 착륙 문제를 해결해 본다. 7장, ‘TRPO와 PPO 구현’에서는 폴리시 개선을 제어하기 위해 신규 메커니즘을 사용한 폴리시 그래디언트 메소드 변경을 제안한다. 이 메커니즘은 폴리시 그래디언트 알고리듬의 안정성과 수렴성을 개선하는 데 사용한다. 특히 TRPO와 PPO 같은 기술을 사용한 2개의 메인 폴리시 그래디언트 메소드를 구현한다. 연속형 액션 공간을 가진 환경인 로보스쿨(RoboSchool)에 구현해본다. 8장, ‘DDPG와 TD3 애플리케이션’에서는 폴리시 그래디언트와 Q-러닝을 모두 결합한 결정적 폴리시 알고리듬이라는 신규 알고리듬을 소개한다. 내부 컨셉을 학습하고 신규 환경에서 2개의 딥 결정적 알고리듬인 DDPG와 TD3를 구현해본다. 9장, ‘모델 기반 강화학습’에서는 미래 액션을 계획하거나 환경 모델을 학습하는 강화학습 알고리듬을 설명한다. 강화학습 알고리듬의 작동 방법, 장점, 많은 상황에서 선호하는 이유를 알게 될 것이다. 모델 기반 강화학습을 마스터하기 위해 로보스쿨에서 모델 기반 알고리듬을 구현해본다. 10장, ‘DAgger 알고리듬으로 이미테이션 학습하기’에서는 이미테이션 학습의 작동 방법과 문제에 적용하고 적합화하는 방법을 설명한다. 가장 잘 알려진 이미테이션 학습 알고리듬인 DAgger를 학습한다. 이 알고리듬을 잘 이해하기 위해 플래피 버드(Flappy Bird)에서 에이전트의 학습과정 속도를 높이는 데 활용해 본다. 11장, ‘블랙박스 최적화 알고리듬 이해하기’에서는 역전파에 의존하지 않는 블랙박스 최적화 알고리듬인 진화 알고리듬을 알아본다. 이 알고리듬은 빠른 훈련과 수백, 수천 개 코어를 이용한 쉬운 병렬화 때문에 관심 받고 있다. 11장은 일종의 진화 알고리듬인 진화 전략 알고리듬에 초점을 둬 이 이론에 대한 이론적 실제 적용 배경을 설명한다. 12장, ‘ESBAS 알고리듬 개발하기’에서는 강화학습에 특화된 중요한 탐색-활용 딜레마를 소개한다. 이 딜레마는 멀티 암트 밴딧 문제를 이용해 데모 시연을 하고 UCB와 UCB1 같은 접근법으로 해결할 것이다. 다음으로 알고리듬 선택 문제를 학습하고 ESBAS 메타 알고리듬을 개발한다. 이 알고리듬은 개별 상황에서 가장 적합한 강화학습 알고리듬을 선택하는 UCB1을 이용한다. 13장, ‘강화학습의 도전적 과제를 해결하기 위한 실제 구현’에서는 이 분야의 주요 도전 과제를 살펴보고 이를 극복하기 위한 몇 가지 사례와 메소드를 설명한다. 강화학습을 실제 현실 문제에 적용하기 위한 몇 가지 도전 과제, 딥 강화학습의 미래 개발, 현실에서의 사회적 임팩트를 학습한다. * 지은이의 말 강화학습은 변화하는 요구 사항에 근거해 이상적 행동을 자동으로 결정할 수 있는 스마트한 모델과 에이전트를 만드는 인기 있고 유망한 인공지능 분야다. 이 책은 에이전트를 개발할 때 강화학습 알고리듬을 마스터하고 구현하는 것을 이해할 수 있도록 도와준다. 강화학습 환경에서 작업해야 하는 도구, 라이브러리, 셋업 소개를 시작으로 강화학습의 빌딩 블록을 다루고 Q-러닝과 SARSA 알고리듬을 응용하는 (등의) 가치 기반 메소드를 상세하게 알아본다. 복잡한 문제를 해결하기 위해 Q-러닝과 신경망의 조합을 이용하는 방법을 소개한다. DDPG와 TD3 같은 결정적 알고리듬을 학습하기 전에 성능과 안정성을 개선하기 위한 폴리시 그래디언트 메소드, TRPO, PPO를 학습할 것이다. 또한 이미테이션 학습 기술이 작동하는 방법과 DAgger가 에이전트를 훈련시키는 방법을 다룬다. 진화 전략과 블랙박스 최적화 기술을 다룬 다음, UCB와 UCB1 같은 탐색 접근법을 학습하고 ESBAS라는 메타 알고리듬을 개발해본다. 이 책을 마칠 시점에는 현실 문제를 해결하기 위해 강화학습 알고리듬을 활용할 수 있는 역량을 갖추고 강화학습 연구 모임에 참여할 수 있을 것이다

펼쳐보기접어보기

회원리뷰 (0건)

매주 10건의 우수리뷰를 선정하여 YES포인트 3만원을 드립니다.
3,000원 이상 구매 후 리뷰 작성 시 일반회원 300원, 마니아회원 600원의 YES포인트를 드립니다.
eBook은 다운로드 후 작성한 리뷰만 YES포인트 지급됩니다.
클래스, CD/LP, DVD/Blu-ray, 패션 및 판매금지 상품, 예스24 앱스토어 상품 제외됩니다. 리뷰/한줄평 정책 자세히 보기 리뷰쓰기

등록된 리뷰가 없습니다.

첫번째 리뷰어가 되어주세요.

한줄평 (0건)

1,000원 이상 구매 후 한줄평 작성 시 일반회원 50원, 마니아회원 100원의 YES포인트를 드립니다.
eBook은 다운로드 후 작성한 리뷰만 YES포인트 지급됩니다.
클래스, CD/LP, DVD/Blu-ray, 패션 및 판매금지 상품, 예스24 앱스토어 상품 제외됩니다. 리뷰/한줄평 정책 자세히 보기

평점 별 2점 별 4점 별 6점 별 8점 별 10점 작성 시 유의사항 한줄평 작성 시 유의사항

한글 기준 50자까지 작성가능 0/50

등록된 한줄평이 없습니다.

첫번째 한줄평을 남겨주세요.

배송/반품/교환 안내

배송 안내

배송 안내
배송 구분	예스24 배송 배송비 : 무료배송
포장 안내	안전하고 정확한 포장을 위해 CCTV를 설치하여 운영하고 있습니다. 고객님께 배송되는 모든 상품을 CCTV로 녹화하고 있으며, 철저한 모니터링을 통해 작업 과정에 문제가 없도록 최선을 다 하겠습니다. 목적 : 안전한 포장 관리 촬영범위 : 박스 포장 작업

반품/교환 안내

※ 상품 설명에 반품/교환과 관련한 안내가 있는경우 아래 내용보다 우선합니다. (업체 사정에 따라 달라질 수 있습니다)

반품/교환 안내
반품/교환 방법	마이페이지 > 반품/교환 신청 및 조회, 1:1 문의, 고객만족센터(1544-3800), 중고샵(1566-4295) 판매자 배송 상품은 판매자와 반품/교환이 협의된 상품에 한해 가능합니다.
반품/교환 가능기간	출고 완료 후 10일 이내의 주문 상품 디지털 콘텐츠인 eBook의 경우 구매 후 7일 이내의 상품 중고상품의 경우 출고 완료일로부터 6일 이내의 상품 (구매확정 전 상태)
반품/교환 비용	고객의 단순변심 및 착오구매일 경우 상품 반송비용은 고객 부담임 직수입양서/직수입일서중 일부는 변심 또는 착오로 취소시 해외주문취소수수료 20%를 부과할수 있음 단, 아래의 주문/취소 조건인 경우, 취소 수수료 면제 오늘 00시 ~ 06시 30분 주문을 오늘 오전 06시 30분 이전에 취소 오늘 06시 30분 이후 주문을 익일 오전 06시 30분 이전에 취소 직수입 음반/영상물/기프트 중 일부는 변심 또는 착오로 취소 시 해외주문취소수수료 30%를 부과할 수 있음 단, 당일 00시~13시 사이의 주문은 취소 수수료 면제 박스 포장은 택배 배송이 가능한 규격과 무게를 준수하며, 고객의 단순변심 및 착오구매일 경우 상품의 반송비용은 박스 당 부과됩니다.
반품/교환 불가사유	소비자의 책임 있는 사유로 상품 등이 손실 또는 훼손된 경우 소비자의 사용, 포장 개봉에 의해 상품 등의 가치가 현저히 감소한 경우 : 예) 화장품, 식품, 가전제품, 전자책 단말기 등 복제가 가능한 상품 등의 포장을 훼손한 경우 : 예) CD/LP, DVD/Blu-ray, 소프트웨어, 만화책, 잡지, 영상 화보집 소비자의 요청에 따라 개별적으로 주문 제작되는 상품의 경우 디지털 컨텐츠인 eBook, 오디오북 등을 1회 이상 다운로드를 받았을 경우 eBook 대여 상품은 대여 기간이 종료 되거나, 2회 이상 대여 했을 경우 취소 불가 중고상품이 구매확정(자동 구매확정은 출고완료일로부터 7일)된 경우 LP상품의 재생 불량 원인이 기기의 사양 및 문제인 경우 (All-in-One 일체형 일부 보급형 오디오 모델 사용 등) 시간의 경과에 의해 재판매가 곤란한 정도로 가치가 현저히 감소한 경우 전자상거래 등에서의 소비자보호에 관한 법률이 정하는 소비자 청약철회 제한 내용에 해당되는 경우
소비자 피해보상	상품의 불량에 의한 반품, 교환, A/S, 환불, 품질보증 및 피해보상 등에 관한 사항은 소비자분쟁해결기준(공정거래위원회 고시)에 준하여 처리됨
환불 지연에 따른 배상	대금 환불 및 환불 지연에 따른 배상금 지급 조건, 절차 등은 전자상거래 등에서의 소비자 보호에 관한 법률에 따라 처리

최근 본 (0)

예스이십사(주): 대표 : 김석환, 최세라 주소 : 서울시 영등포구 은행로 11, 5층~6층(여의도동,일신빌딩) 사업자등록번호 : 229-81-37000 통신판매업신고 : 제 2005-02682호 사업자 정보확인 이메일 : yes24help@yes24.com 호스팅 서비스사업자 : 예스이십사(주)
Copyright ⓒ YES24 Corp. All Rights Reserved.

고객문의

도서/음반 1544-3800

중고샵 1566-4295

티켓예매 1544-6399

eBook 1:1 문의
1:1 문의하기 자주 묻는 질문 상담시간 안내

소비자피해보상보험 서울보증보험: 고객님은 안전거래를 위해 현금 등으로 결제 시 저희 쇼핑몰에서 가입한 구매안전서비스를 이용하실 수 있습니다. 서비스가입사실 확인

EQUUS6

YES24 카테고리 리스트

YES24 유틸메뉴

어깨배너

빠른분야찾기

파이썬 기반 강화학습 알고리듬

DP, Q-Learning, AC, DQN, TRPO, PPO, DDPG, TD3, Imitation Learning, ESBAS 알아보기

파이썬 기반 강화학습 알고리듬

출판사 추천

품목정보

관련분류

이 상품의 이벤트 (7개)

책소개

목차

저자 소개 (2명)

만든 이 코멘트

출판사 리뷰

회원리뷰 (0건)

한줄평 (0건)

배송/반품/교환 안내

도착예상일

도착예상일
상품준비	출고완료	도착예상일