일반기술

압축된 뉴스 영상에서의 문자영역 추출 및 문자 인식방법과, 이러한 프로그램을 기록한 컴퓨터로 읽을 수 있는 기록매체

*원리 및 개요본 기술은 주문형 뉴스(NOD : News On Demand)를 실현하기 위한 압축된 뉴스 영상의 내용기반 뉴스 색인 및 검색 방법이다.*중요성 및 독창성 멀티미디어를 위한 가장 중요한 국제표준으로 주목받고 있는 동영상의 압축방식( MPEG : Moving Picture Experts Group) 중의 하나인 MPEG-2로 압축된 스포츠 뉴스 영상으로부터 문자영역을 추출하고 문자를 인식하는 방법에 관한 것이다.*특징 및 장점본 기술은 아래와 같은 단계로 압축된 뉴스 영상에서의 문자영역 추출 및 문자 인식방법을 특징으로 한다.1) 1단계 : 압축된 뉴스 영상을 구성하는 I-프레임들 중에서 수평, 수직, 대각선 계수 값이 일정값 이상인 DCT(Discrete Cosine Transform:이산코사인변환) 블록의 개수가 임계치 이상일 때 해당 I-프레임을 문자 프레임으로 검사하여 찾아내는 단계2)2단계 : 1단계에서 검출된 문자 프레임에서 픽셀 사이의 기울기(gradient)가 일정값보다 크게 나타나는 문자 영역을 추출하는 단계3) 3단계 : 2단계에서 추출된 문자 영역을 이진화하는 단계4) 4단계 : 3단계에서 추출된 문자 영역을 문자 부분과 배경 부분으로 분할하여 이진화 된 문자 영역의 배경 부분을 은폐(隱蔽 -사진제판 용어: masking )하는 단계5) 5단계 : 4단계의 배경 부분이 은폐된 이진화 문자 영역을 필터링하여 노이즈를 제거하는 단계6) 6단계 : 5단계의 이진화 된 문자 영역을 개별 문자별로 분리하고 분리된 개별 문자를 정규화하는 단계7) 7단계 : 6단계의 정규화 된 개별 문자를 인식하는 단계*효과1) 뉴스 영상을 복호화하지 않고 DCT 계수를 이용하여 프레임 내의 문자 유무를 판단하기 때문에 시간 소요를 줄일 수 있다.2) 뉴스 영상의 캡션 문자들은 많은 노이즈를 포함하기 때문에 문자의 특징을 사용하여 문자 영역을 검출하고, 검출된 영역의 이진화시 비디오 영상에 적합한 연속되는 프레임의 합성, 이중 문턱치와 영역 확장, 분할과 병합 알고리즘을 이용함으로써, 문자 인식률을 향상시킨다.3) 본 기술을 응용하면 압축된 뉴스 영상을 이용하여, 주문형 뉴스(NOD)를 위한 내용기반 뉴스 색인 및 검색이 가능해진다.

기술정보

기술분류
통신 > 기타 통신
보유기관
호남제주공공기술이전컨소시엄
기술유형
일반기술
등록일
2005-11-01
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.