레플리
글 수 27

OpenAI의 멀티 에이전트 강화학습 환경 - Neural MMO

조회 수 975 추천 수 0 2019.03.06 20:09:56


 

https://blog.openai.com/neural-mmo/

 

 

 

OpenAI에서 새로운 강화학습 환경을 공개했습니다. 기존에 있던 OpenAI Gym은 슈퍼마리오나 블록격파처럼 싱글 게임에 최적화되어 있습니다. 이번에 발표한 Neural MMO는 멀티 에이전트를 위한 가상 환경입니다.

 

거의 온라인 게임과 비슷하다고 보면 됩니다. 128개의 에이전트가 동시에 동작하는데 랜덤하게 만들어진 타일맵을 돌아다닙니다. 물이나 음식 타일에 가면 체력을 회복하고, 다른 에이전트를 만나면 밀리, 원거리, 마법사 타입에 따라 전투를 합니다. 한 턴마다 보상을 1씩 받는데, 오래 살아남도록 행동을 학습합니다.

 

훈련 결과를 보면 최대한 경쟁을 피하기 위해 맵 전체로 넓게 퍼지는 경향을 보인다고 합니다. 호모 사피엔스가 아프리카에서 시작하여 새로운 땅을 찾아 전 세계로 이동한 것과 비슷한 것 같습니다.

 

엮인글 :
List of Articles
제목 글쓴이 날짜sort 조회 수
딥마인드의 게임을 학습하는 딥러닝 인공지능 깊은바다 2016-03-21 980
MDP 기반의 스케줄링 구현 file [1] 깊은바다 2016-03-24 2122
강화학습 기반의 자율적인 행동 학습 file 깊은바다 2016-03-24 2521
강화학습 기반의 지능적인 가상캐릭터 file 깊은바다 2016-03-24 620
딥러닝 강화학습으로 둠 게임 구현 깊은바다 2017-02-28 709
딥 강화학습 쉽게 이해하기 [2] 깊은바다 2017-02-28 1928
딥 강화학습으로 퐁 게임 학습 file 깊은바다 2017-03-13 1963
텐서플로우에서 DQN 강화학습으로 캐치게임 구현 file 깊은바다 2017-03-18 6860
강화학습 Q-Learning과 DQN에 대한 설명 깊은바다 2017-03-27 9924
신경망 Q-Learning으로 구현한 오목 게임 깊은바다 2017-03-29 15638
알파고를 탄생시킨 강화학습의 비밀 깊은바다 2017-06-25 859
알아두면 쓸데있는 신기한 강화학습 깊은바다 2017-08-24 1145
강화학습과 DQN 소개 깊은바다 2017-10-05 1365
스타크래프트2 강화학습 깊은바다 2017-10-14 1073
DQN 강화학습으로 슈퍼마리오 인공지능 구현 깊은바다 2017-10-30 2728