일반기술
한국어 문자열간의 전역 유사도 측정 방법
본 기술은 정보 검색, 기계 번역 등의 한국어 정보 처리에 있어서, 두 개의 한국어 문자열간의 전역 유사도를 정량적으로 측정하여 두 문자열의 뒤틀림 정도를 측정할 수 있도록 하는 방법에 관한 것이다.기존의 유니 코드에는 한글 음절을 초성, 중성, 종성으로 표현하였지만, 이러한 한글 음절로는 모든 한글의 음절을 표현할 수 없고, 또한 한글 음절로 되어 있는 한글로부터 자음 모음을 체계적으로 분리 조합할 수 없어 한글 정보를 처리할 경우, 한국어 문자열의 유사도 측정이나 정렬 등에 많은 어려움이 있다.따라서, 본 기술은 기존의 유니 코드에서 자모 배열을 새롭게 수정하여 새로운 1차원 한글 코드 체계를 정의함으로써, 한글 음절을 모두 표현하고, 한글로부터 자음 모음을 체계적으로 분리 조합할 수 있으며, 두 개의 한국어 문자열간의 전역 유사도를 정량적으로 측정하여 두 문자열의 뒤틀림 정도를 측정하고자 한다.본 기술에 의한 한국어 문자열간의 전역 유사도 측정 방법은 사용자로부터 한글 문자열을 수신하는 단계, 유니 코드에서 자음과 모음의 배열을 새롭게 수정하여 정의한 새로운 1차원 한글 코드에 의해 완성된 한글 문자열을 등록하는 단계, 한글 코드에 의해 완성된 문자열과 수신된 한글 문자열간을 자모 동적시간정렬로 활용하여 두 문자열간의 전역 유사도를 측정하는 단계를 포함한다.이와 같이 이루어진 본 기술에 의하면, 유니 코드에서 자모 배열을 새롭게 수정하여 새로운 1차원 코드 쳬계를 정의함으로써, 두 개의 한국어 문자열간의 전역 유사도를 정량적으로 측정하여 두 문자열의 뒤틀림 정도를 측정할 수 있는 효과가 있다.
기술정보
- 기술분류
- 정보 > 기타 소프트웨어
- 보유기관
- 포항공과대학교
- 기술유형
- 일반기술
- 등록일
- 2001-06-15
- 데이터 갱신일
- 정보 없음
상세설명
정보 없음
관련 특허
등록된 관련 특허가 없습니다.