일반기술
잡음환경에 강인한 문맥독립 화자인식 기술
(1) 개요본 기술은 휴대통신단말장치나 로봇장치에 연결된 마이크로폰을 통해 문장형태의 음성을 입력받아 등록된 화자를 원거리(3~5m)에서 인식하고, 다양한 잡음환경하에서 강인한 문장독립(text-independent) 형태의 화자인식을 수행할 수 있을뿐만 아니라 여러 종류의 응용 프로그램에 활용할 수 있는 사용자 인식에 있어서 핵심기술이다.(2) 목적 및 필요성본 기술은 휴대단말장치나 로봇장치에 연결된 마이크로폰을 통해 문장형태의 음성을 입력받아 등록된 화자를 인식하고, 원거리(3~5m)에서 발성하거나 다양한 잡음환경하에서 강인한 문장독립(text-independent) 형태의 화자인식을 수행할 수 있을뿐만 아니라 여러 종류의 응용 프로그램에 활용할 수 있는 사용자 인식에 있어서 핵심기술이다. 본 기술은 지능형 로봇, 디지털 홈, 보안 시스템 분야에서 근거리 뿐만 아니라 원거리(3~5m)에서도 화자인식의 필요성이 증대되고 있으며, 카메라를 통해 얼굴인식을 수행하기 어려운 상황에서 사용자의 음성으로부터 화자를 인식하는 기술이 필요하다. 이 기술은 인간과 기계간의 상호작용에 대한 연구가 활발히 진행됨에 따라 음성 인터페이스에 대한 수요가 점점 많아지고 있다. 또한, 최근 몇 년 동안 얼굴인식, 음성인식과 함께 자연스러운 서비스 및 편의를 제공할 수 있도록 하기 위해 계속 연구되어온 분야로써 음성을 기반으로 한 사용자 인식 분야에서는 핵심 기술로 계속 연구되어 온 분야이다. 본 기술은 음성기반 화자인식 시스템을 Windows 기반에서 Visual C++을 사용한 모듈형태의 화자 인식 및 음성처리 플랫폼을 구축하여 인식시스템의 유지 보수 및 응용성을 극대화시킬 수 있도록 하였다.(1) 활용방안 및 기대성과본 기술은 지능형로봇 분야에서 로봇과 함께 생활하는 사용자의 목소리를 듣고, 누구인가를 알아낼 수 있는 방법으로 사용자와 로봇의 거리가 비교적 멀어질 수 있는 환경에서도 성능이 우수하며, 어떠한 방향에서도 잘 동작할 수 있습니다. 등록된 사용자의 선호도에 따른 차별화된 서비스를 제공하기 위하여 사용자 확인이 필요할 때 사용될 수 있다. 또한, 디지털 홈, 텔레매틱스 등의 분야에서도 널리 사용될 것으로 기대되며, 그 밖에도 공공기관 및 은행, 공항등 에서의 보안 시스템으로 사용 가능하다. 또한, 문맥독립 화자인식 기술은 저가인 마이크를 사용하여 음성을 취득하기 용이하고 일반 PC 또는 PDA, 핸드폰 등에 기본적으로 탑재되어 있으므로, 다른 인식에 비해 취득 장치에 드는 비용이 거의 없다는 장점이 있다. 또한, 전화나 인터넷을 이용하여 원격지에서도 사용이 가능하여, 텔레뱅킹 등 다른 인식방법을 적용할 수 없는 응용분야에서 사용될 수 있다. 금번에 개발된 잡음환경에 강인한 문맥독립 화자 인식 기술은 자연스러운 인간과 컴퓨터사이의 상호작용을 통해 다양한 인식 응용 분야에 세계적인 상용화 제품의 창출이 가능하며, 세계 시장을 선점할 수 있는 자동화기술로 큰 의의가 있을 것으로 본다. 본 기술의 개발에 의하여 국내외적으로 선진 애로 기술 확보가 가능하며 또한 화자 인식 상용 시스템의 활성화 및 소프트웨어의 국외수출 등의 효과를 기대할 수 있다. (2) 기술이전범위 ① 화자인식 시스템 ㄱ. 음성처리 모듈 - 음성처리 플랫폼 - au 파일 포맷 지원 기능 ㄴ. 끝점 및 특징 추출 모듈 - 끝점추출 기능 - 음성 특징추출 기능 ㄷ. 등록화자 모델링 및 인식 모듈 - 등록화자 모델 구축 기능 - 화자 혼합도 추출 기능 - 화자 인식 기능
기술정보
- 기술분류
- 전기·전자 > 기타 전기/전자
- 보유기관
- 한국전자통신연구원
- 기술유형
- 일반기술
- 등록일
- 2007-07-31
- 데이터 갱신일
- 정보 없음
상세설명
정보 없음
관련 특허
등록된 관련 특허가 없습니다.