일반기술

티티에스 시스템의 음성압축 및 합성 방법

* 주요 내용TTS 시스템의 음성압축 및 합성 방법에 있어, 양자화 테이블을 이용하여 양자화된 선형 예측 계수를 통해 얻어진 잔차 신호를 유성음 및 천이구간에서 추출한 후 신호 파형의 유사도를 측정하여 생성된 화자 종속적 코드북을 이용하고; 상기 화자 종속적 코드북은 시간 축에서 잔차 신호 파형의 유사도를 비교함으로써 다양한 형태의 신호로 코드북을 훈련시켜 코드북을 생성하는; 것을 특징으로 하는 TTS 시스템의 음성압축 및 합성방법.* 구체적 설명본 발명은 음성합성(Text-To-Speech, TTS)에 관한 것으로서, 특히 TTS시스템에서 필요로 하는 대용량의 음성 데이터베이스를 효율적으로 압축하는 방법에 관한 것이다.음성합성은 수집된 음성데이터를 가공한 언어자료 데이터베이스를 기반으로 하여 수행된다. 이를 단계별로 살펴보면, 음성합성을 위한 데이터베이스를 준비하는 과정으로는 원시 데이터로부터 음성합성을 위하여 가공된 최적 코퍼스(corpus)선택단계; 코퍼스 녹음단계(recording); 음소 분절(segmentation) 및 음소 정보 부여(labeling) 단계; 데이터를 압축하여 저장하기 위한 파형코딩(wavecoding)단계; 음성 데이터 베이스화 단계; 음소-음향 파라미터 추출단계; 음소별 정보를 데이터 베이스화하는 단계; 데이터 절삭(pruning)단계를 포함한다. 또한 입력된 문자를 준비된 데이터베이스를 이용하여 처리하는 음성을 만드는 과정으로는, 문자입력단계; 문자 전처리(preprocessing)단계; 품사분석 및 운율정보 생성단계; 철자 음소변환단계; 유닛 DB로부터 유닛을 선택하는 단계; 음율변환단계(prosody conversion); 접속 및 평활화 단계 및 음성출력단계로 이루어진다.* 과제본 발명이 이루고자 하는 기술적 과제는 TTS 시스템의 음성 합성을 위해 원 음성 신호로 구성된 데이터베이스를 종래의 트랜스폼 코딩 방식에 비해 높은 비율로 압축하는 방법을 제공하는데 있다. 본 발명이 이루고자 하는 또 다른 기술적 과제는 합성하고자 하는 문장에 해당하는 정보를 데이터베이스 내에서 추출한 후, 이를 이용해 음성 신호를 복원함에 있어 기존 상용 코덱 수준의 좋은 음질을 얻는 방법을 제공하는 것에 있다.본 발명이 이루고자 하는 또 다른 기술적 과제는 압축된 파라미터들을 이용한 음성 신호 합성 시 발생할 수 있는 신호들 간 연결부에서의 불연속성이 존재하지 않도록 하는 방법을 제공하는데 있다.* 효과본 발명에 따른 TTS시스템의 음성 압축 및 합성방방법에 의하면, 한 화자의 음성 신호로 구성된 TTS시스템의 대용량 데이터베이스에 적용된 화자 종속적 코드북은 제한된 크기로도 화자의 유성음 및 천이구간에 대한 신호를 잘 모델링할 수 있다. 뿐만 아니라, 비예측 방식과 예측 방식을 혼용함으로써 평균 전송율 측면에서도 기존 상용 코덱 수준의 높은 압축률을 가짐과 동시에 음소 단위의 가변적이고 부분적인 음성 합성에 있어서도 상용 코덱 수준의 우수한 음질을 나타낸다.

기술정보

기술분류
전기·전자 > 기타 전자요소 기술
보유기관
연세대학교
기술유형
일반기술
등록일
2007-03-19
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.