메뉴 건너뛰기
소속 기관 / 학교 인증
인증하면 논문, 학술자료 등을  무료로 열람할 수 있어요.
한국대학교, 누리자동차, 시립도서관 등 나의 기관을 확인해보세요
(국내 대학 90% 이상 구독 중)
고객센터 ENG
주제분류

논문 기본 정보

저자정보
(충남대학교) (충남대학교) (충남대학교) (충남대학교)
저널정보
한국정보기술학회 Proceedings of KIIT Conference 한국정보기술학회 2021년도 추계종합학술대회 및 대학생논문경진대회
오류 신고하기

피인용 0

검색

    초록·키워드

    PPT를 이용하여 발표 동영상을 제작할 때 슬라이드 별로 녹음을 진행하여 동영상을 제작한다. 이때 수정사항이 발생하면 다시 녹음해야 한다는 불편함이 있다. 이 문제를 보완하기 위해 PFT에 TTS를 삽입하여 동영상을 만드는 서비스가 존재하지만 기존 생성한 음성 모델만 사용 가능하다. 따라서 개인의 목소리 모델을 만들어 동영상 제작에 사용할 수 있는 서비스 제안을 위해 회귀 모델인 Tacotron2과 비자기 회귀 모델인 FastSpeech2를 비교하여 개인화된 TTS에 이용할 수 있는지 연구하였다. 연구 결과 학습 속도는 FastSpeech2가 우세하고, 합성된 음성의 음질은 Tacotron2이 우세하였다. 실제 개인화 TTS 서비스를 개발하기 위해서는 속도 및 음질이 개선된 모델의 연구가 필요하다.

    최근 본 자료 전체보기

      UCI(KEPA) : I410-ECN-0101-2021-004-002164341