일반기술
계층적 피드백 구조를 갖는 음성인식 시스템
본 기술은 두 단계로 이루어져있는 계층적 구조를 가지면서 위단계와 아래단계가 피드백 루프로 구성된 시스템에 관한 것이다. 기존의 무제한 연속음성인식에 적합한 상향식 접근법은 매 프레임마다 고정된 일정 부분을 인식한 후, 가장 높은 인식 값을 갖는 문장을 비터비 알고리즘을 이용해서 찾는 방법이다. 하지만, 이 방법은 음소의 천이 구간에서 인식율이 급격히 저하되는 현상을 나타낸다. 이로인해 많은 삽입에러가 발생하고, 다음 단계의 후처리과정이 매우 어렵다. 이에 대한 해결책으로 음소의 천이구간을 먼저 검출한 후, 최적의 음소열을 예측하는 방법이 있다. 그러나 이와 같은 방법에서도 다른 문제점이 있는데 이는 끝점검출 단계에서의 작은 에러가 다음 단계로의 천이과정에서 증폭된다는 것이다. 이는 각 단계가 독립적으로 설계되어진 데에 일차적인 원인이 있고, 보다 근본적인 원인은 위단계에서 아래단계로의 정보의 유입이 없고, 이로인한 에러의 교정이 아래단계에서 이루어지지 않는데에 있다.본 기술은 위의 문제점을 해결하기 위한 것으로서, 본 기술은 두 단계로 이루어져 있는 계층적인 구조를 갖으면서 위 단계와, 아래 단계가 피드백루프로 구성된 계층적 피드백 구조를 갖는 음성인식 시스템이다. 본 기술에 따른 계층적 피드백 구조를 갖는 음성인식 시스템은 음성 인식시스템에 있어서 음성신호를 셉스트럼계수열로 변환시키는 전처리부와, 계수열 및 인식결과데이터를 이용하여 음성신호 및 끝점을 검출하는 끝점검출부와, 음성신호 및 끝점을 이용하여 경계구간을 예측하고, TDNN을 이용하여 고립인식을 행하여 음소측정값을 출력하는 인식부와, 언어의 패턴을 대표하는 기설정된 측정 파라메트 및 음성측정값을 이용하여 음소열을 결정하는 라벨링부와, 음소열에 대응한 결과 데이터를 룩업테이블을 이용하여 출력하는 음성발생부를 구비한다. 따라서 인식률이 1.4% 높고 에러율은 3.2%가 낮은 효과가 있다.
기술정보
- 기술분류
- 정보 > 기타 시스템 소프트웨어
- 보유기관
- 포항공과대학교
- 기술유형
- 일반기술
- 등록일
- 2001-05-11
- 데이터 갱신일
- 정보 없음
상세설명
정보 없음
관련 특허
등록된 관련 특허가 없습니다.