DC Field | Value | Language |
---|---|---|
dc.contributor.author | 황형주 | ko |
dc.contributor.author | 장영수 | ko |
dc.contributor.author | 박재영 | ko |
dc.contributor.author | 김기응 | ko |
dc.date.accessioned | 2021-03-04T00:50:24Z | - |
dc.date.available | 2021-03-04T00:50:24Z | - |
dc.date.created | 2021-03-03 | - |
dc.date.created | 2021-03-03 | - |
dc.date.created | 2021-03-03 | - |
dc.date.issued | 2020-01 | - |
dc.identifier.citation | 정보과학회논문지, v.47, no.1, pp.88 - 94 | - |
dc.identifier.issn | 2383-630X | - |
dc.identifier.uri | http://hdl.handle.net/10203/281163 | - |
dc.description.abstract | 본 논문에서는 사전확률 갱신을 수행하는 교차 엔트로피 계획법에 관해 기술한다. 교차 엔트로피 계획법은 실시간 계획법(online planning)에서 많이 사용하는 방법론으로 가상환경으로부터 표본(sample)을 추출하고 추출된 표본으로부터 평가된 가치를 기반으로 최적의 행동(action)을 선택한다. 기존 교차 엔트로피 계획법은 최적화 과정에서 이전에 얻어진 탐색결과를 활용하지 않고 매번 새롭게 탐색을 수행한다. 따라서 정해진 시간 내에 탐색을 수행해야 할 경우, 도달할 수 있는 성능이 제한되어 있다. 본 논문에서는 행동 차원에 대한 교차 엔트로피 계획법의 결과물을 활용하여 최적화 과정에서의 사전확률을 갱신하고, 이를 통해 점차 높은 성능을 보일 수 있는 방법론을 제안한다. 또한, 실험에서는 물리 기반 가상환경(OpenAI Gym)에서 교차 엔트로피 계획법과 비교를 통해 제안된 방법론을 평가한다. | - |
dc.language | Korean | - |
dc.publisher | 한국정보과학회 | - |
dc.title | 사전확률 갱신을 수행하는 교차 엔트로피 계획법 | - |
dc.title.alternative | Cross-Entropy Planning with Prior Updates | - |
dc.type | Article | - |
dc.type.rims | ART | - |
dc.citation.volume | 47 | - |
dc.citation.issue | 1 | - |
dc.citation.beginningpage | 88 | - |
dc.citation.endingpage | 94 | - |
dc.citation.publicationname | 정보과학회논문지 | - |
dc.identifier.doi | 10.5626/JOK.2020.47.1.88 | - |
dc.identifier.kciid | ART002551395 | - |
dc.contributor.localauthor | 김기응 | - |
dc.contributor.nonIdAuthor | 박재영 | - |
dc.description.isOpenAccess | N | - |
dc.subject.keywordAuthor | 교차 엔트로피 계획법 | - |
dc.subject.keywordAuthor | 실시간 계획법 | - |
dc.subject.keywordAuthor | 개방형 루프 계획법 | - |
dc.subject.keywordAuthor | 순차적 의사 결정 | - |
dc.subject.keywordAuthor | cross-entropy method | - |
dc.subject.keywordAuthor | online planning | - |
dc.subject.keywordAuthor | open-loop planning | - |
dc.subject.keywordAuthor | sequential decision making | - |
Items in DSpace are protected by copyright, with all rights reserved, unless otherwise indicated.