인문학
사회과학
자연과학
공학
의약학
농수해양학
예술체육학
복합학
지원사업
학술연구/단체지원/교육 등 연구자 활동을 지속하도록 DBpia가 지원하고 있어요.
커뮤니티
연구자들이 자신의 연구와 전문성을 널리 알리고, 새로운 협력의 기회를 만들 수 있는 네트워킹 공간이에요.
논문 기본 정보
- 저자정보
초록·키워드
일화기억은 생명체의 개인적 경험에 대한 기억으로 뇌의 해마(hippocampus)에서 주로 관여하며 경험을 통한 학습을 가능하게 한다. 일화기억은 발생 당시에 유발된 감정에 따라 보상기억과 부정기억으로 구분된다. 각 기억들은 뇌의 기저측편도(basolateral amygdala) 부근에서 교차된 보상회로와 부정회로를 통해 각각 저장된다. 본 논문에서는 상기한 생물학적 합의를 바탕으로, 분기된 일화기억에 기반하여 정책을 학습하는 방법인 행동-대조학습을 제안한다. 행동-대조학습에서는 환경에서 제공되는 보상의 성격에 따라 보상기억과 부정기억에 나누어 저장하고 보상기억에서의 행동은 강화하도록, 부정기억에서의 행동은 약화하도록 학습한다. 실험을 통해 제안된 방법으로 학습한 정책이 MNIST 환경과 Atari Pong 환경에서 보상을 획득하는 방향으로 행동함을 확인하였다. 또한, saliency map 분석을 통해 정책이 행동을 선택하는 근거의 타당성을 확인하였다.
본문·목차
인공지능 문자 인식 모델을 통해 추출된 텍스트로, 일부 오타나 오류가 포함될 수 있으나 지속적으로 개선 중입니다.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.