일반기술

텍스트/음성 변환기에서 신경망을 이용한 에너지컨투어 생성 방법

본 발명은 텍스트/음성 변환기(text-to-speech conversion system)에서 신경망을 이용한 에너지 컨투어 생성 방법에 관한 것이다. 종래 합성기는 입력된 텍스트로부터 합성음을 생성하는데 있어서 에너지 컨투어 제어를 인접한 합성단위간의 에너지 컨투어 평활화와 강세 정도의 처리 만을 하고 있다. 그러므로 종래의 텍스트/음성변환기 방식을 이용하여 문장단위의 에너지 컨투어를 제어하기는 불가능하다. 따라서, 본 발명은 음운환경, 단어간 끊어읽기, 앞/현재/뒤 단어의 평균 피치값을 입력으로 하는 다층신경망을 이용한 학습방법을 사용하여 문장내 음절의 에너지값을 추정, 합성음 생성에 사용함으로써 합성음의 자연성 구현을 그 목적으로 한다.본 발명은 입력 텍스트에 대한 언어처리 결과를 입력받아서 문장내 음절의 에너지값을 출력하는 다층신경망을 이용하여 실제 음성데이타의 음절 에너지값으로 학습하고, 학습 결과를 이용하여 텍스트/음성 변환기에서 문장단위의 에너지 컨투어를 생성하는 방식을 통해 문장내 에너지 변화를 제어함으로써 합성음의 자연성이 향상되므로 텍스트/음성 변환기의 자연성이 요구되는 응용분야인 통신 서비스, 사무 자동화, 교육 등의 여러 분야에 응용할 수 있는 효과가 있다.

기술정보

기술분류
정보 > 인공지능
보유기관
한국전자통신연구원
기술유형
일반기술
등록일
2002-07-09
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.