인문학
사회과학
자연과학
공학
의약학
농수해양학
예술체육학
복합학
개인구독
소속 기관이 없으신 경우, 개인 정기구독을 하시면 저렴하게
논문을 무제한 열람 이용할 수 있어요.
지원사업
학술연구/단체지원/교육 등 연구자 활동을 지속하도록 DBpia가 지원하고 있어요.
커뮤니티
연구자들이 자신의 연구와 전문성을 널리 알리고, 새로운 협력의 기회를 만들 수 있는 네트워킹 공간이에요.
초록·키워드
PPT를 이용하여 발표 동영상을 제작할 때 슬라이드 별로 녹음을 진행하여 동영상을 제작한다. 이때 수정사항이 발생하면 다시 녹음해야 한다는 불편함이 있다. 이 문제를 보완하기 위해 PFT에 TTS를 삽입하여 동영상을 만드는 서비스가 존재하지만 기존 생성한 음성 모델만 사용 가능하다. 따라서 개인의 목소리 모델을 만들어 동영상 제작에 사용할 수 있는 서비스 제안을 위해 회귀 모델인 Tacotron2과 비자기 회귀 모델인 FastSpeech2를 비교하여 개인화된 TTS에 이용할 수 있는지 연구하였다. 연구 결과 학습 속도는 FastSpeech2가 우세하고, 합성된 음성의 음질은 Tacotron2이 우세하였다. 실제 개인화 TTS 서비스를 개발하기 위해서는 속도 및 음질이 개선된 모델의 연구가 필요하다.
본문·목차
인공지능 문자 인식 모델을 통해 추출된 텍스트로, 일부 오타나 오류가 포함될 수 있으나 지속적으로 개선 중입니다.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.
오류를 발견하셨다면 해당 부분을 드래그한 후 ' 를 통해 신고해주세요.
최근 본 자료 전체보기
UCI(KEPA) : I410-ECN-0101-2021-004-002164341