일반기술

한국어 기본음소단위군으로 구성한 한국어 형태소발음사전을사용한한국어연속음성인식시스템및그방법

본 기술은 한국어 연속음성 인식시스템 및 그 방법에 관한 것으로 한국어 기본 음소 단위군으로 구성한 한국어 형태소 발음사전을 사용하였다. 본 장치는 입력된 음성의 특징을 추출하는 장치와 서브워드 모델과 한국어 형태소 발음 사전을 이용한 형태소 모델링 장치, 위의 두 장치로부터 출력물을 입력 받아 음성을 형태소 단위로 비터비 탐색을 통해 인식하는 장치, 형태소 문법 또는 형태 구문 문법을 사용하여 새로 인식된 형태소가 문법에 적합한지의 여부를 검사하여 적어도 하나 이상의 문장을 선택, 출력하는 문장 인식 장치로 구성되어있다.기존의 한국어 음성인식시스템은 어절 단위로 문장을 인식하여 문장의 종류가 많아지면 인식해야하는 단위는 급속도로 증가하게 되어 무제한 음성인식 시스템이 될 수 없게 된다. 이를 해결하기 위해 수십 개의 음로를 최소 인식 단위로 할 때, 기본 단위의 인식률이 떨어져 문장 인식률은 현저하게 낮아진다. 본 기술은 한국어가 형태소, 어절, 문장의 3단계 구조로 이루어져 있고 어절은 일정 개수 이하의 형태소 조합으로 이루어져 있음에 착안하여 한국어 기본 음소 단위 군을 제안하고 이로 구성한 한국어 형태소 발음사전을 만들어 사용하여 형태 구문 문법을 사용하여 올바른 인식 문장을 최소한 한 개 이상 출력하는 새로운 한국어 연속음성 인식 시스템 및 그 방법이다. 본 장치는 입력된 음성의 특징을 추출하는 장치와 형태소를 한국어 발음사전을 이용하여 모델링하는 장치, 압의 두 장치로부터 입력받은 정보를 탐색하여 형태소 단위로 인식하는 장치 및 새로 인식된 형태소가 문법에 적합한지 여부를 검사하여 문장을 인식, 적어도 하나 이상의 문장을 출력하는 장치로 구성되어 있다. 본 기술은 한국어에서 음소 규칙 및 변이음 규칙을 거쳐 발음되는 모든 변이음들을 기호화하여 정의하여 한국어 기본 음소 단위 군을 만들어 사용함으로써 한국어의 음소단위를 모두 표현할 수 있고, 이 정의된 음소단위들을 실제 음성인식에 사용할 때 형태소 발음사전을 구현하여 형태소 단위의 모델링을 함으로써 제한된 개수의 형태소를 가지고도 무제한 한국어 연속음성 인식시스템을 구현할 수 있으며, 또한 한국어의 형태소와 어절과 문장의 3단계의 구조에 대응하는 형태소인식과 단어인식과 문장인식의 3단계를 거치므로 한국어에서 형태소들끼리의 연관관계 및 가능성, 어절들이 문장을 이루는 연관관계 및 가능성을 각 인식단계별로 손쉽게 사용하여 음성 인식률을 높일 수 있는 효과가 있다.

기술정보

기술분류
통신 > 음성·문자·언어인식처리 기술
보유기관
(주)케이티
기술유형
일반기술
등록일
2006-03-06
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.