RISS 학술연구정보서비스

검색

인기 검색어

    다국어 입력

    http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.

    변환된 중국어를 복사하여 사용하시면 됩니다.

    예시)
    • 中文 을 입력하시려면 zhongwen을 입력하시고 space를누르시면됩니다.
    • 北京 을 입력하시려면 beijing을 입력하시고 space를 누르시면 됩니다.
    닫기
    KCI등재

    한국어 문장 표절 유형을 고려한 유사 문장 판별 = A Detection Method of Similar Sentences Considering Plagiarism Patterns of Korean Sentence

    한글로보기

    https://www.riss.kr/link?id=A82503931

    • 0

      상세조회
    • 0

      다운로드
    서지정보 열기
    • 내보내기
    • 내책장담기
    • 공유하기
    • 오류접수

    부가정보

    국문 초록 (Abstract) kakao i 다국어 번역

    본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결과를 토대로 LSA와 N-gram을 이용한 유사 문장 검색을 통하여 여러 유형의 표절로부터 견고한 유사 문장 판별 모델을 구현하였다. 제안한 모델의 성능 분석을 위해서 학생들이 인위적으로 작성한 표절 리포트와 표절한 첨부 문서로 실험 데이터를 구축하였다. 성능 비교를 위해서는 기존의 N-gram 모델, 벡터모델, LSA 모델이 사용되었으며, 실험 결과 제안한 모델이 정확률, 재현율, 그리고 F값 척도에서 우수한 성능을 보임을 알 수 있었다.
    번역하기

    본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결...

    본 논문은 한국어 표절 검사를 위해서 표절의 유형을 분석하여, 유형별 분석 결과를 기반으로 하여 유사 문장 판별 모델을 제안한다. 제안하는 방법은 한국어 문장에 대한 표절 유형 분석 결과를 토대로 LSA와 N-gram을 이용한 유사 문장 검색을 통하여 여러 유형의 표절로부터 견고한 유사 문장 판별 모델을 구현하였다. 제안한 모델의 성능 분석을 위해서 학생들이 인위적으로 작성한 표절 리포트와 표절한 첨부 문서로 실험 데이터를 구축하였다. 성능 비교를 위해서는 기존의 N-gram 모델, 벡터모델, LSA 모델이 사용되었으며, 실험 결과 제안한 모델이 정확률, 재현율, 그리고 F값 척도에서 우수한 성능을 보임을 알 수 있었다.

    더보기

    다국어 초록 (Multilingual Abstract) kakao i 다국어 번역

    In this paper, we proposed a method to find out similar sentences from documents to detect plagiarized documents. The proposed model adapts LSA and N-gram techniques to detect every type of Korean plagiarized sentence type. To evaluate the performance of the model, we constructed experimental data using students` essays on the same theme. Students made their essay by intentionally plagiarizing some reference documents. The experimental results showed that our proposed model outperforms the conventional N-gram model, Vector model, LSA model in precision, recall, and F measures.
    번역하기

    In this paper, we proposed a method to find out similar sentences from documents to detect plagiarized documents. The proposed model adapts LSA and N-gram techniques to detect every type of Korean plagiarized sentence type. To evaluate the performance...

    In this paper, we proposed a method to find out similar sentences from documents to detect plagiarized documents. The proposed model adapts LSA and N-gram techniques to detect every type of Korean plagiarized sentence type. To evaluate the performance of the model, we constructed experimental data using students` essays on the same theme. Students made their essay by intentionally plagiarizing some reference documents. The experimental results showed that our proposed model outperforms the conventional N-gram model, Vector model, LSA model in precision, recall, and F measures.

    더보기

    참고문헌 (Reference)

    1 장정호, "헬름홀츠머신 학습 기반의 의미 커널을 이용한 문서 유사도 측정" 30 : 2003

    2 조준희, "한국어 문서 표절 검사를 위한 LSA와 N-gram 기반의 유사 문장 판별" 고려대학교 2009

    3 최성원, "주변 문장 유사도를 이용한 문서 재사용 측정 모델" 고려대학교 2005

    4 류창건, "일반화된 정렬 가중치 모델을 이용한 내용 기반 문서 검색 시스템" 2008

    5 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009

    6 조정현, "웹 검색과 문서 유사도를 활용한 2 단계 신문 기사 표절 탐지 시스템" 한국정보처리학회 16 (16): 181-194, 2009

    7 "보도자료 : 표절 문제 전담 해결을 위한 표절 위원회 출범, 문화체육관광부"

    8 이인철, "동아일보 디지털 스토리:‘표절한국’ 이젠 바로잡자" 동아닷컴 2007

    9 김혜숙, "단어/단어쌍 특징과 신경망을 이용한 두 문서간 유사도 측정" 한국정보과학회 31 (31): 1660-1671, 2004

    10 강호정, "과학글쓰기를 잘하려면 기승전결을 버려라" 이음출판사 2007

    1 장정호, "헬름홀츠머신 학습 기반의 의미 커널을 이용한 문서 유사도 측정" 30 : 2003

    2 조준희, "한국어 문서 표절 검사를 위한 LSA와 N-gram 기반의 유사 문장 판별" 고려대학교 2009

    3 최성원, "주변 문장 유사도를 이용한 문서 재사용 측정 모델" 고려대학교 2005

    4 류창건, "일반화된 정렬 가중치 모델을 이용한 내용 기반 문서 검색 시스템" 2008

    5 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009

    6 조정현, "웹 검색과 문서 유사도를 활용한 2 단계 신문 기사 표절 탐지 시스템" 한국정보처리학회 16 (16): 181-194, 2009

    7 "보도자료 : 표절 문제 전담 해결을 위한 표절 위원회 출범, 문화체육관광부"

    8 이인철, "동아일보 디지털 스토리:‘표절한국’ 이젠 바로잡자" 동아닷컴 2007

    9 김혜숙, "단어/단어쌍 특징과 신경망을 이용한 두 문서간 유사도 측정" 한국정보과학회 31 (31): 1660-1671, 2004

    10 강호정, "과학글쓰기를 잘하려면 기승전결을 버려라" 이음출판사 2007

    11 Narayanan Shivakumar, "SCAM : A Copy Detection Mechanism for digital Documents" 1995

    12 Saket Mengle, "Passage Detection Using Text Classification" 60 (60): 2009

    13 Paul Clough, "Measuring Text Reuse" 40 : 152-159, 2002

    14 JangWon Seo, "Local Text Reuse Detection" 2008

    15 신동호, "LSA를 이용한 내용기반 검색엔진 시스템" 서울대학교 2000

    더보기

    동일학술지(권/호) 다른 논문

    동일학술지 더보기

    더보기

    분석정보

    View

    상세정보조회

    0

    Usage

    원문다운로드

    0

    대출신청

    0

    복사신청

    0

    EDDS신청

    0

    동일 주제 내 활용도 TOP

    더보기

    주제

    연도별 연구동향

    연도별 활용동향

    연관논문

    연구자 네트워크맵

    공동연구자 (7)

    유사연구자 (20) 활용도상위20명

    인용정보 인용지수 설명보기

    학술지 이력

    학술지 이력
    연월일 이력구분 이력상세 등재구분
    2027 평가 재인증평가 신청대상 (재인증)
    2021-01-01 등재 등재학술지 유지 (재인증) KCI등재
    2018-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2015-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2011-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2009-01-01 등재 등재 1차 FAIL (등재유지) KCI등재
    2006-01-01 등재 등재학술지 선정 (등재후보2차) KCI등재
    2005-01-01 등재 등재후보 1차 PASS (등재후보1차) KCI등재후보
    2003-07-01 등재 등재후보학술지 선정 (신규평가) KCI등재후보
    더보기

    학술지 인용정보

    학술지 인용정보
    기준연도 WOS-KCI 통합IF(2년) KCIF(2년) KCIF(3년)
    2016 1.67 1.67 1.56
    KCIF(4년) KCIF(5년) 중심성지수(3년) 즉시성지수
    1.49 1.42 2.251 0.64
    더보기

    이 자료와 함께 이용한 RISS 자료

    나만을 위한 추천자료

    해외이동버튼