메뉴 건너뛰기
소속 기관 / 학교 인증
인증하면 논문, 학술자료 등을  무료로 열람할 수 있어요.
한국대학교, 누리자동차, 시립도서관 등 나의 기관을 확인해보세요
(국내 대학 90% 이상 구독 중)
고객센터 ENG
주제분류

논문 기본 정보

저자정보
(전북대학교) (네이버) (네이버) (네이버) (전북대학교)
저널정보
Korean Institute of Information Scientists and Engineers 정보과학회 컴퓨팅의 실제 논문지 정보과학회 컴퓨팅의 실제 논문지 제30권 제6호
오류 신고하기

피인용 0

검색

    초록·키워드

    방대한 데이터셋을 기반으로 대형 언어 모델(Large Language Model)이 급속도로 발전하고 있는 가운데, 언어 모델이 생성한 텍스트의 안전성에 대한 연구가 중시되고 있다. 본 연구에서는 Plug-and-Play Language Model (PPLM) 방법을 적용하여 한국어 언어 모델의 생성을 제어하는 실험을 수행한다. 이를 위해 독성 이진 분류기인 작은 크기의 Attribute 모델을 학습한 후, 언어 모델과 결합하여 생성 시에 언어 모델이 비독성 문장을 생성하도록 업데이트한다. 실험 결과, Attribute 모델이 적용되었을 때 독성이 23%가 감소하며 성공적으로 모델이 제어됨을 입증하였다.

    최근 본 자료 전체보기