키워드 부합 스카이라인 처리

On Processing Keyword-Matched Skylines

초록

본 논문에서는 새로운 형태의 스카이라인 질의인 키워드 부합 스카이라인 질의를 소개한다. 키워드 부합 스카이라인 질의는 텍스트 정보를 포함한 차원 튜플 집합에서 질의 키워드를 가지는 집합의 스카이라인을 구하는 문제이다. 기존 스카이라인 질의처리 기법은 텍스트 검색을 처리하지 못하기 때문에 이미 찾은 키워드 부합 튜플들로부터 다시 스카이라인을 구해야 하며 이는 많은 부하를 유발한다. 따라서 본 논문에서는 키워드 부합 스카이라인 질의를 위한 효율적인 질의처리 알고리즘을 제안한다. 제안 알고리즘은 IR2-Tree을 색인 구조로 사용하고 분기한정법을 이용해 트리를 순회한다. 따라서 순회동안 튜플의 벡터와 텍스트 정보를 둘 다 고려하여 방문할 필요가 없는 노드는 효율적으로 가지치기 한다. 제안 알고리즘의 성능평가를 위해 기저 알고리즘인 역색인 스카이라인 검색기법을 추가적으로 제안하고 키워드 부합 스카이라인 질의처리 기법과 비교평가 한다. 성능평가는 연산 시간 및 I/O비용 및 초점을 맞추어 수행되며 성능평가 결과는 제안 알고리즘이 기저 알고리즘보다 우수하다는 것을 잘 보여준다.

키워드

Text Information RetrievalPareto TupleDatabase스카이라인텍스트 정보 검색파레토 튜플데이터베이스Skyline
제목
키워드 부합 스카이라인 처리
제목 (타언어)
On Processing Keyword-Matched Skylines
저자
최현식성민경정연돈
발행일
2009
저널명
데이타베이스연구
25
3
페이지
113 ~ 129