한국어 문장 표절 유형을 고려한 유사 문장 판별

A Detection Method of Similar Sentences Considering Plagiarism Patterns of Korean Sentence

초록

본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결과를 토대로 LSA와 N-gram을 이용한 유사 문장 검색을 통하여 여러 유형의 표절로부터 견고한 유사 문장 판별 모델을 구현하였다. 제안한 모델의 성능 분석을 위해서 학생들이 인위적으로 작성한 표절 리포트와 표절한 첨부 문서로 실험 데이터를 구축하였다. 성능 비교를 위해서는 기존의 N-gram 모델, 벡터모델, LSA 모델이 사용되었으며, 실험 결과 제안한 모델이 정확률, 재현율, 그리고 F값 척도에서 우수한 성능을 보임을 알 수 있었다.

키워드

plagiarismsimilar sentenceN-gram modelLSA model표절유사 문장N-gram 모델LSA 모델
제목
한국어 문장 표절 유형을 고려한 유사 문장 판별
제목 (타언어)
A Detection Method of Similar Sentences Considering Plagiarism Patterns of Korean Sentence
저자
지혜성임희석조준희
DOI
10.32431/kace.2010.13.6.008
발행일
2010
저널명
컴퓨터교육학회 논문지
13
6
페이지
79 ~ 89