일반기술
유성음 / 무성음 / 묵음 정보를 이용한 동적 시간정합고립단어 인식 시스템
본 기술은 고립단어 인식 시스템에 있어서, 각각의 인식 대상 단어의 음성에 대하여 유성음, 무성음, 묵음의 코드 구간으로 분리하고, 분리된 코드 구간의 조합으로 이루어진 코드워드 패턴별로 상기 단어의 음성들을 표준 음성 패턴으로서 분류하여 저장한 데이터베이스; 입력되는 원 음성 신호로부터 제 1 특징 변수들을 추출하고, 상기 원 음성을 전처리하여 제 2 특징 변수들을 추출하여 상기 추출된 제 1 및 제 2 특징 변수들을 이용하여 원 음성 신호의 테스트 음성 패턴을 생성하고, 상기 원 음성 신호로부터 유성음, 무성음, 묵음 코드의 구간별 경계 정보를 추출하는 전처리 수단; 상기 제 1 및 제 2 특징 변수들을 이용하여 유성음, 무성음, 묵음 구간으로 구분되는 코드워드를 형성하고 상기 형성된 코드워드에 대응하는 코드워드 패턴을 갖는 표준 음성 패턴들을 상기 데이터베이스로부터 검색하는 코드워드 분류 수단; 상기 원 음성 신호의 테스트 패턴과 상기 데이터베이스로부터 검색된 표준 음성의 패턴을 각각의 구간 경계 정보를 이용하여 구간별로 부분적으로 동적 시간정합 알고리즘을 적용하여 패턴 정합을 수행하여 인식 결과를 생성하는 패턴 정합 수단을 포함하는 것을 특징으로 하는 음성 인식 시스템에 관한 것이다.본 기술은 고립단어 인식 시스템에 관한 것으로, 종래의 음성 인식에 사용되는 동적 시간정합 알고리즘의 계산량 부담을 감축시키기 위하여 유성음/무성음/묵음 정보를 이용한다. 먼저, 유성음/무성음/묵음 분류기를 통해 입력 음성으로부터 유성음/무성음/묵음 코드워드와, 각 코드에 해당하는 구간별 경계 정보를 추출하고, 데이터베이스내의 표준 패턴들중에서 입력 음성 신호에 대하여 구성된 유성음/무성음/묵음 코드워드와 동일한 코드워드를 갖는 표준 패턴들을 선택한다. 패턴 정합부는 원 음성 신호의 구간별 경계 정보를 이용하여 데이터베이스로부터 선택된 표준 패턴과 입력 음성 신호 패턴과의 유사성 비교를 수행함으로써 정확한 인식 결과를 출력한다.; 따라서, 일차적으로 원 입력 음성에 대응하는 코드워드를 갖는 표준 패턴만을 비교 대상으로 하고, 이차적으로 구간별로 패턴 정합이 수행되기 때문에 종래 기술에 비하여 상당한 계산량 감축 효과가 있다.
기술정보
- 기술분류
- 통신 > 기타 통신
- 보유기관
- 한국과학기술원
- 기술유형
- 일반기술
- 등록일
- 2006-05-24
- 데이터 갱신일
- 정보 없음
상세설명
정보 없음
관련 특허
등록된 관련 특허가 없습니다.