일반기술

바이오 텍스트 마이닝 기술

(1) 개요 바이오 텍스트 마이닝 기술은 방대한 바이오 정보로부터 보다 빠르게 사용자들이 원하는 정보를 선택적으로 검색해 사용할 수 있도록 하기 위하여 바이오 문헌을 대상으로 자연어 처리 및 정보 추출 기술을 적용하고 이에 기본적인 정보검색 기술을 결합해 정렬된 데이터를 제공하는 것이다. (2) 목적 및 필요성 바이오 문헌은 생물학자들이 실험을 통하여 얻은 결과를 정제한 데이터로서 고 품질의 데이터를 제공한다. 이와 같이 방대한 바이오 문헌으로부터 단백질 상호작용 등 바이오 객체간의 관계를 추출하여 네트워크를 구축하고 이를 활용하기 위한 연구가 선진국에서는 이미 시작되었으며 최근 제품화 되고 있으나 매우 고가로 널리 활용되지 못하고 있는 실정이다. 본 기술이전은 국내에서는 아직 상용화 단계의 기술이 없는 초기 단계이고 국외에서는 뛰어난 성능의 제품이 없는 상황에서 국내의 바이오인포매틱스 관련 업체에 바이오 텍스트 마이닝 기술을 이전하여 제품화를 목적으로 한다.(1) 활용방안 및 기대성과 본 기술이전을 통하여 대량의 바이오 문헌으로부터 생물학자가 관심 있는 문헌의 검색 및 중요 객체간의 정보를 추출할 수 있다. 객체간의 중요 정보는 단백질 상호작용 등과 같은 정보가 될 수 있다. 문헌 정보의 활용은 생물학자가 필요한 정보를 초기에 쉽게 얻을 수 있게 하여준다. 이를 활용하면 대용량 바이오 네트워크 구축을 할 수 있으며 최종적으로 신약개발 등의 정보로 활용될 수 있다. (2) 기술이전범위 ① 관심 문헌의 검색 및 수집 기술 -PubMed abstract 검색 및 수집 -USPTO 문서 검색 및 수집 ② 관심 문헌으로부터의 생물학적 중요 개체명 추출 기술 -단백질, 유전자, 질병 등 40 종류 ③ 관심 문헌으로부터 추출된 중요 개체간의 관계 추출 기술 -단백질 상호작용 -유전자 질병간 관계 ④ 추출된 관계 가시화 기술 -네트워크 가시화 -테이블을 이용한 정렬 및 탐색

기술정보

기술분류
생명과학 > 기타 생명과학
보유기관
한국전자통신연구원
기술유형
일반기술
등록일
2007-07-31
데이터 갱신일
정보 없음

상세설명

정보 없음

관련 특허

등록된 관련 특허가 없습니다.