일반기술

발음 접속 그래프를 이용한 TTs 처리 방법 및 연속 음성 인식 방법

본 발명은 TTS 시스템과 연속 음성 인식 시스템 등 음성을 처리하는 시스템에서 한 문장에 대한 형태소별 품사, 원형, 표층, 발음, 접속 정보 등을 통합해서 그래프 형식으로 효율적으로 표현하고 처리할 수 있는 방법에 관한 것이다.; 본 발명에 의한 발음 접속 그래프를 구성하는 발음 접속 노드를 기록한 컴퓨터로 읽을 수 있는 기록매체에 있어서, 발음 접속 노드는 하나의 형태소의 품사를 저장하는 형태소 품사 필드; 형태소가 발음되는 문자열을 저장하는 형태소 발음 필드; 형태소가 상기 형태소 발음 필드에 저장된 문자열에 따라 발음될 확률을 저장하는 확률 정보 필드; 형태소의 최초 음소의 철자 및 발음을 저장하는 좌측 음운 접속 정보 필드 및 형태소의 마지막 음소의 철자 및 발음을 저장하는 우측 음운 접속 정보 필드; 및 형태소 이전에 발음되는 이전 형태소를 저장한 하나 이상의 발음 접속 노드들을 액세스하기 위한 포인터들을 저장한 전 발음 접속 노드 필드 및 상기 형태소 이후에 발음되는 이후 형태소를 저장한 하나 이상의 발음 접속 노드들을 액세스하기 위한 포인터들을 저장한 후 발음 접속 노드 필드를 구비한다.; 본 발명에 의하면, 하나의 형태소에 대해서 나타나는 여러 후보 발음을 발음 접속 그래프 형태로 표현함으로써, TTS 시스템 및 연속 음성 인식 시스템에서 사용하는 메모리의 절약과 함께 전체적인 성능 향상을 꾀할 수 있다. 하나의 텍스트 문장을 음성으로 변환하는 TTS 시스템에서 처리되는 정보를 표현하는 발음 접속 그래프를 구성하는 발음 접속 노드를 기록한 컴퓨터로 읽을 수 있는 기록매체에 있어서, 하나의 형태소의 품사를 저장하는 형태소 품사 필드; 상기 형태소가 발음되는 문자열을 저장하는 형태소 발음 필드; 상기 형태소가 상기 형태소 발음 필드에 저장된 문자열에 따라 발음될 확률을 저장하는 확률 정보 필드; 상기 형태소의 최초 음소의 철자 및 발음을 저장하는 좌측 음운 접속 정보 필드 및 상기 형태소의 마지막 음소의 철자 및 발음을 저장하는 우측 음운 접속 정보 필드; 및 상기 형태소 이전에 발음되는 이전 형태소를 저장한 하나 이상의 발음 접속 노드들을 액세스하기 위한 포인터들을 저장한 전 발음 접속 노드 필드 및 상기 형태소 이후에 발음되는 이후 형태소를 저장한 하나 이상의 발음 접속 노드들을 액세스하기 위한 포인터들을 저장한 후 발음 접속 노드 필드를 구비하는 것을 특징으로 하는 발음 접속 노드를 기록한 컴퓨터가 읽을 수 있는 기록매체.

기술정보

기술분류
정보 > 소프트웨어공학
보유기관
포항공과대학교
기술유형
일반기술
등록일
2007-08-10
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.