일반기술

음성인터페이스

음성인식의 궁극적인 목표는 인간과 마찬가지로 자연스럽게 발성되는 모든 음성을 인식할 수 있는 수준이어야 하지만 기술적인 한계가 있으므로 기술 수준에 따라 음성인식을 여러단계로 나누어 연구를 수행하고 있음<기술의 특징> - 잡음환경 대응 음성 인식기에서 잡음환경하에서 인식된 음성 신호에 대하여 스펙트럼 크기의 정규화(Normalization of spectral magnitude)와 켑스트럼 변환(Cepstral transformation)을 통한 롬바드 효과(Lombard effect)의 보정으로 인식되는 음성에 대하여 효과적인 잡음처리로 안정된 음성 인식을 제공 - 한문어 음성 변환 주어진 입력 문서를 음성으로 변환시키는 문서 음성 변환 시스템에서 통계적 언어 처리 기법을 도입하여 합성음의 자연성을 좌우하는 운율 생성 모듈에 더욱 정확한 발음 표기 및 구문 구조를 제공 - 고속 화자 인식 고속 화자 인식 디지털 휴대통신 핸드셋에서 음성의 전달을 위한 음성 부호화기 (vocoder)에서 주로 사용되는 LSP 계수를 이용한 화자 확인 - 전화망 음성인식 독립형 화자 식별 방법으로 화자식별의 중요한 응용분야인 전화망에서는 대역폭의 제한과 전송선에 의한 채널응답특성에 의해 비선형적인 왜곡이 나타나게 되고 이로 인해 심각한 성능저하가 해결 독립성분분석을 이용하여 음성의 특징벡터를 새로운 특징공간으로 사상 - 혼합 대중대역 혼합 유성음 성분과 무성음 성분이 모든 주파수 대역에서 혼합될 수 있도록 하여 양질의 음성 서어비스를 제공 - 고품질 합성음 음성의 스펙트럼 포락을 계산하고, 이와 같이 생성된 스펙트럼포락을 피치주기와 각 고조파 대역별 유/무성음 정보를 사용하여 유성음 스펙트럼 포락과 무성음 스펙트럼 포락으로 분리한 뒤에, 분리되어진 스펙트럼 포락을 사용하여 유성음과 무성음을 합성하여, 합성된 유성음과 무성음을 시간영역에서 더하여 합성음을 생성

기술정보

기술분류
통신 > 기타 통신
보유기관
한국과학기술원
기술유형
일반기술
등록일
2008-03-25
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.