강화학습 - tensorflow-js로 만들어본 RL 예제: 2. Deep-sarsa

글 수 27

조회 수 2528 추천 수 0 2018.07.27 15:11:39

깊은바다 *.68.247.188 http://aidev.co.kr/5539

Q-network

tensorflow.js는 올해 4월에 발표된 것인데 자바스크립트로 학습을 할 수 있습니다. 이를 사용해서 웹에서 직접 동작하는 간단한 강화학습을 구현한 글입니다. 녹색 점이 빨간색 장애물을 피해 노란색 목표로 다가가는 방법을 배웁니다.

Sarsa는 Q-learng과 거의 비슷한데 다만 Q값을 업데이트 방법이 약간 다릅니다. 다음 상태의 최대 Q값이 아니라 현재 수행한 행동의 Q값을 사용한다는 차이가 있습니다.

코드는 아래 링크를 참고하세요.
-> https://github.com/Hulk89/gridworld_tfjs

List of Articles

제목	글쓴이	날짜	조회 수
신경망 Q-Learning으로 구현한 오목 게임	깊은바다	2017-03-29	15637
강화학습 Q-Learning과 DQN에 대한 설명	깊은바다	2017-03-27	9924
텐서플로우에서 DQN 강화학습으로 캐치게임 구현	깊은바다	2017-03-18	6860
DQN 강화학습으로 슈퍼마리오 인공지능 구현	깊은바다	2017-10-30	2728
강화학습 관련 노하우 정리	깊은바다	2019-07-29	2688
tensorflow-js로 만들어본 RL 예제: 2. Deep-sarsa	깊은바다	2018-07-27	2528
강화학습 기반의 자율적인 행동 학습	깊은바다	2016-03-24	2521
MDP 기반의 스케줄링 구현 [1]	깊은바다	2016-03-24	2122
딥 강화학습으로 퐁 게임 학습	깊은바다	2017-03-13	1963
딥 강화학습 쉽게 이해하기 [2]	깊은바다	2017-02-28	1928
새로운 강화학습 방식인 니마시니 알고리즘	깊은바다	2018-06-03	1590
스타2 강화학습 튜토리얼 [2]	깊은바다	2018-02-04	1534
강화학습과 DQN 소개	깊은바다	2017-10-05	1365
웹브라우저에서 자율주행차 강화학습 프로젝트 [2]	깊은바다	2018-06-21	1255
데미스 하사비스의 카이스트 강연 - 아타리 게임 DQN과 알파고의 원리	깊은바다	2019-07-24	1202

쓰기

첫 페이지 1 2 끝 페이지