본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결...

http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=A82503931
2010
Korean
표절 ; 유사 문장 ; N-gram 모델 ; LSA 모델 ; plagiarism ; similar sentence ; N-gram model ; LSA model
028.6
KCI등재
학술저널
79-89(11쪽)
10
0
상세조회0
다운로드본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결...
본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결과를 토대로 LSA와 N-gram을 이용한 유사 문장 검색을 통하여 여러 유형의 표절로부터 견고한 유사 문장 판별 모델을 구현하였다. 제안한 모델의 성능 분석을 위해서 학생들이 인위적으로 작성한 표절 리포트와 표절한 첨부 문서로 실험 데이터를 구축하였다. 성능 비교를 위해서는 기존의 N-gram 모델, 벡터모델, LSA 모델이 사용되었으며, 실험 결과 제안한 모델이 정확률, 재현율, 그리고 F값 척도에서 우수한 성능을 보임을 알 수 있었다.
다국어 초록 (Multilingual Abstract)
In this paper, we proposed a method to find out similar sentences from documents to detect plagiarized documents. The proposed model adapts LSA and N-gram techniques to detect every type of Korean plagiarized sentence type. To evaluate the performance...
In this paper, we proposed a method to find out similar sentences from documents to detect plagiarized documents. The proposed model adapts LSA and N-gram techniques to detect every type of Korean plagiarized sentence type. To evaluate the performance of the model, we constructed experimental data using students` essays on the same theme. Students made their essay by intentionally plagiarizing some reference documents. The experimental results showed that our proposed model outperforms the conventional N-gram model, Vector model, LSA model in precision, recall, and F measures.
참고문헌 (Reference)
1 장정호, "헬름홀츠머신 학습 기반의 의미 커널을 이용한 문서 유사도 측정" 30 : 2003
2 조준희, "한국어 문서 표절 검사를 위한 LSA와 N-gram 기반의 유사 문장 판별" 고려대학교 2009
3 최성원, "주변 문장 유사도를 이용한 문서 재사용 측정 모델" 고려대학교 2005
4 류창건, "일반화된 정렬 가중치 모델을 이용한 내용 기반 문서 검색 시스템" 2008
5 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009
6 조정현, "웹 검색과 문서 유사도를 활용한 2 단계 신문 기사 표절 탐지 시스템" 한국정보처리학회 16 (16): 181-194, 2009
7 "보도자료 : 표절 문제 전담 해결을 위한 표절 위원회 출범, 문화체육관광부"
8 이인철, "동아일보 디지털 스토리:‘표절한국’ 이젠 바로잡자" 동아닷컴 2007
9 김혜숙, "단어/단어쌍 특징과 신경망을 이용한 두 문서간 유사도 측정" 한국정보과학회 31 (31): 1660-1671, 2004
10 강호정, "과학글쓰기를 잘하려면 기승전결을 버려라" 이음출판사 2007
1 장정호, "헬름홀츠머신 학습 기반의 의미 커널을 이용한 문서 유사도 측정" 30 : 2003
2 조준희, "한국어 문서 표절 검사를 위한 LSA와 N-gram 기반의 유사 문장 판별" 고려대학교 2009
3 최성원, "주변 문장 유사도를 이용한 문서 재사용 측정 모델" 고려대학교 2005
4 류창건, "일반화된 정렬 가중치 모델을 이용한 내용 기반 문서 검색 시스템" 2008
5 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009
6 조정현, "웹 검색과 문서 유사도를 활용한 2 단계 신문 기사 표절 탐지 시스템" 한국정보처리학회 16 (16): 181-194, 2009
7 "보도자료 : 표절 문제 전담 해결을 위한 표절 위원회 출범, 문화체육관광부"
8 이인철, "동아일보 디지털 스토리:‘표절한국’ 이젠 바로잡자" 동아닷컴 2007
9 김혜숙, "단어/단어쌍 특징과 신경망을 이용한 두 문서간 유사도 측정" 한국정보과학회 31 (31): 1660-1671, 2004
10 강호정, "과학글쓰기를 잘하려면 기승전결을 버려라" 이음출판사 2007
11 Narayanan Shivakumar, "SCAM : A Copy Detection Mechanism for digital Documents" 1995
12 Saket Mengle, "Passage Detection Using Text Classification" 60 (60): 2009
13 Paul Clough, "Measuring Text Reuse" 40 : 152-159, 2002
14 JangWon Seo, "Local Text Reuse Detection" 2008
15 신동호, "LSA를 이용한 내용기반 검색엔진 시스템" 서울대학교 2000
중국어 특징을 반영한 RFID/USN 기반 중국어 상황학습 시스템
그래픽 기반 시뮬레이션을 활용한 상호배제 교육방법 연구
정보교과 교수내용지식(PCK) 수준 측정 문항 개발 및 타당화
학술지 이력
| 연월일 | 이력구분 | 이력상세 | 등재구분 |
|---|---|---|---|
| 2027 | 평가 | 재인증평가 신청대상 (재인증) | |
| 2021-01-01 | 등재 | 등재학술지 유지 (재인증) | ![]() |
| 2018-01-01 | 등재 | 등재학술지 유지 (등재유지) | ![]() |
| 2015-01-01 | 등재 | 등재학술지 유지 (등재유지) | ![]() |
| 2011-01-01 | 등재 | 등재학술지 유지 (등재유지) | ![]() |
| 2009-01-01 | 등재 | 등재 1차 FAIL (등재유지) | ![]() |
| 2006-01-01 | 등재 | 등재학술지 선정 (등재후보2차) | ![]() |
| 2005-01-01 | 등재 | 등재후보 1차 PASS (등재후보1차) | ![]() |
| 2003-07-01 | 등재 | 등재후보학술지 선정 (신규평가) | ![]() |
학술지 인용정보
| 기준연도 | WOS-KCI 통합IF(2년) | KCIF(2년) | KCIF(3년) |
|---|---|---|---|
| 2016 | 1.67 | 1.67 | 1.56 |
| KCIF(4년) | KCIF(5년) | 중심성지수(3년) | 즉시성지수 |
| 1.49 | 1.42 | 2.251 | 0.64 |