일반기술
히든 마르코프 모델링 방식(HMM)의 음성인식 시스템에서의 음성인식 방법
본 기술은 서브워드의 비터비 계산량을 줄여 실시간으로 음성을 인식할 수 있는 히든 마르코프 모델링 방식(HMM)의 음성인식 시스템에서의 음성인식 방법으로 초기화 후에 프레임이 마지막 프레임인지 확인하고 마지막 프레임인 경우 인식 결과를 출력하고 마지막이 아닌 경우 서브워드 단위로 비터비 일차 계산을 수행한 후 단어 단위로 비터비 이차 계산을 하여 비터비 값을 구하고 언어 처리 과정을 행하여 마지막 프레임 판단 과정을 반복적으로 거쳐 비터비를 계산한다. 본 기술은 입력된 음성의 특징을 추출하는 장치, 단어 모델링 장치, 앞의 두 장치로부터 입력 받은 정보를 통해 비터비를 계산하여 단어를 인식하는 장치, 단어 인식 수단으로부터 입력받은 정보로 문장을 인식하는 장치로 구성되어 있다.기존에는 서브워드 유니트를 이용하여 선형 구조와 트리 구조로 단어를 표시하였다. 선형 구조의 경우 반복 사용되는 서브워드 유니트도 각각의 비터비로 계산을 하였다. 트리 주고의 경우는 공유되는 서브워드 유니트의 연속 음성을 인식하여 계산량은 줄었으나 문법적인 정보를 추가하기는 어렵다. 본 기술은 비터비 계산량을 줄이기 위한 서브워드 일차 및 이차 계산을 나누어 수행하는 음성인식 방법이다. 음성이 입력되면 음성의 고유 특징을 특징 추출부에서 추출하여 단어 인식부로 출력한다. 단어 인식부가 음성의 특징과 단어모델 정보를 받아 비터비 계산을 수행하여 단어를 인식하면 문장 인식부에서 문장을 인식한다. 이때 단어 인식부에서는 언어 모델의 정보를 이용하여 이전에 구해진 단어 정보 다음에 올 수 있는 후보 단어를 선택한다. 음성 인식 시스템을 초기화한 후, 마지막 프레임 여부를 판단하여 마지막 프레임이 아니면 모든 서브워드에 대하여 비터비 일차 계산을 하고 현 프레임에서 가능한 모든 후보 단어에 대해서 이차 계산을 수행하여 비터비 값을 구하여 언어 처리 과정을 수행하고 마지막 프레임이 될 때까지 이를 반복하여 음성을 인식한다. 이러한 과정을 통해 본 발명은 비터비 계산량을 획기적으로 줄일 수 있어 실시간으로 음성을 인식할 수 있는 효과가 있다.
기술정보
- 기술분류
- 전기·전자 > 기타 전기/전자
- 보유기관
- (주)케이티
- 기술유형
- 일반기술
- 등록일
- 2006-03-14
- 데이터 갱신일
- 정보 없음
상세설명
정보 없음
관련 특허
등록된 관련 특허가 없습니다.