인문학
사회과학
자연과학
공학
의약학
농수해양학
예술체육학
복합학
지원사업
학술연구/단체지원/교육 등 연구자 활동을 지속하도록 DBpia가 지원하고 있어요.
커뮤니티
연구자들이 자신의 연구와 전문성을 널리 알리고, 새로운 협력의 기회를 만들 수 있는 네트워킹 공간이에요.
논문 기본 정보
- 저자정보
초록·키워드
거대언어모델(Large Language Model, LLM)의 활용이 확대됨에 따라, 인간 중심 응답과 사회적 책임성을 고려한 인간 선호 정렬 (human preference alignment)의 중요성이 부각되고 있다. 기존의 감독학습(Supervised Fine-Tuning, SFT) 방식이 인간의 가치 판단을 반영하는 데 한계가 있음에 따라, 최근 이를 극복하기 위한 다양한 강화학습 기반의 알고리즘이 제안되고 있다. 본 연구에서는 PPO, DPO, CPO, ORPO, KTO와 같은 주요 RLHF(Reinforcement Learning from Human Feedback) 기반 알고리즘의 인간 선호 ... 전체 초록 보기
본문·목차
인공지능 문자 인식 모델을 통해 추출된 텍스트로, 일부 오타나 오류가 포함될 수 있으나 지속적으로 개선 중입니다.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.
최근 본 자료 전체보기
UCI(KEPA) : I410-151-25-02-093746170