RISS 학술연구정보서비스

검색

인기 검색어

    다국어 입력

    http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.

    변환된 중국어를 복사하여 사용하시면 됩니다.

    예시)
    • 中文 을 입력하시려면 zhongwen을 입력하시고 space를누르시면됩니다.
    • 北京 을 입력하시려면 beijing을 입력하시고 space를 누르시면 됩니다.
    닫기
    KCI등재

    구문의미분석을 이용한 유사문서 판별기

    한글로보기

    https://www.riss.kr/link?id=A99934691

    • 0

      상세조회
    • 0

      다운로드
    서지정보 열기
    • 내보내기
    • 내책장담기
    • 공유하기
    • 오류접수

    부가정보

    국문 초록 (Abstract) kakao i 다국어 번역

    문서 저작권에 대한 관심과 중요성이 높아짐에 따라 문서 복제나 표절의 검출에 대한 필요성이 증대되고 있다. 이와 같은 이유로 많은 연구가 이루어지고 있으나 자연어 처리기술의 한계가 있어 문서의 심층적 표절 검출에 어려움이 있다.본 논문은 자연어 분석의 기술을 적용한 유사문서 판별기를 설계,구현한다. 이 시스템은 형태소 분석의 기술과 함께 구문의미 분석의 기술, 저빈도 및 관용표현 가중치을 이용하여 유사문서를 판별한다. 본 시스템의 성능을 실험하기 위하여 휴먼 판별과 기존 시스템, 그리고 휴먼 판별과 제안한 시스템의 판별과의 상관계수를 분석하였다. 실험결과, 구문의미 분석을 활용한 시스템의 개선점을 발견할 수 있었다. 앞으로 문서 유형을 정의하고 각 유형에 맞는 판별 기법을 개발할 필요가 있다.
    번역하기

    문서 저작권에 대한 관심과 중요성이 높아짐에 따라 문서 복제나 표절의 검출에 대한 필요성이 증대되고 있다. 이와 같은 이유로 많은 연구가 이루어지고 있으나 자연어 처리기술의 한계가 ...

    문서 저작권에 대한 관심과 중요성이 높아짐에 따라 문서 복제나 표절의 검출에 대한 필요성이 증대되고 있다. 이와 같은 이유로 많은 연구가 이루어지고 있으나 자연어 처리기술의 한계가 있어 문서의 심층적 표절 검출에 어려움이 있다.본 논문은 자연어 분석의 기술을 적용한 유사문서 판별기를 설계,구현한다. 이 시스템은 형태소 분석의 기술과 함께 구문의미 분석의 기술, 저빈도 및 관용표현 가중치을 이용하여 유사문서를 판별한다. 본 시스템의 성능을 실험하기 위하여 휴먼 판별과 기존 시스템, 그리고 휴먼 판별과 제안한 시스템의 판별과의 상관계수를 분석하였다. 실험결과, 구문의미 분석을 활용한 시스템의 개선점을 발견할 수 있었다. 앞으로 문서 유형을 정의하고 각 유형에 맞는 판별 기법을 개발할 필요가 있다.

    더보기

    다국어 초록 (Multilingual Abstract) kakao i 다국어 번역

    Owing to importance of document copyright the need to detectd ocument duplication and plagiarism is increasing. Many studies have so ught to meet such need, but there are difficulties indocument duplication detection due to technological limitations with the processing of natural language. This thesis designs and implements a discriminator of similar documents with natural language processing technique. This system discriminates similar documents using morphological analysis, syntactic analysis, and weight on low frequency and idiom. To evaluate the system, we analyze the correlation between human discrimination and term-based discrimination, and between human discrimination and proposed discrimination. This analysis shows that the proposed discrimination needs improving. Future research should work to define the document type and improve the processing technique appropriate for each type.
    번역하기

    Owing to importance of document copyright the need to detectd ocument duplication and plagiarism is increasing. Many studies have so ught to meet such need, but there are difficulties indocument duplication detection due to technological limitations w...

    Owing to importance of document copyright the need to detectd ocument duplication and plagiarism is increasing. Many studies have so ught to meet such need, but there are difficulties indocument duplication detection due to technological limitations with the processing of natural language. This thesis designs and implements a discriminator of similar documents with natural language processing technique. This system discriminates similar documents using morphological analysis, syntactic analysis, and weight on low frequency and idiom. To evaluate the system, we analyze the correlation between human discrimination and term-based discrimination, and between human discrimination and proposed discrimination. This analysis shows that the proposed discrimination needs improving. Future research should work to define the document type and improve the processing technique appropriate for each type.

    더보기

    목차 (Table of Contents)

    • 요약
    • Abstract
    • Ⅰ. 서론
    • Ⅱ. 문서 해석 기술
    • Ⅲ. 구문의미 분석을 이용한 유사문서 식별 시스템
    • 요약
    • Abstract
    • Ⅰ. 서론
    • Ⅱ. 문서 해석 기술
    • Ⅲ. 구문의미 분석을 이용한 유사문서 식별 시스템
    • Ⅳ. 실험 및 분석
    • Ⅴ. 결론 및 논의
    • 참고문헌
    더보기

    참고문헌 (Reference)

    1 조동욱, "효과적인 e-런닝 시스템 구축을 위한 과제물 표절 검사" 1 (1): 53-59, 2003

    2 류창건, "한글 말뭉치를 이용한 한글 표절 탐색 모델 개발" 한국정보과학회 14 (14): 231-235, 2008

    3 전명재, "한글 구조특성과 지역정렬 알고리즘을 사용한 표절 판정시스템의 개발" 31 (31): 727-729, 2004

    4 지혜성, "한국어 문장 표절 유형을 고려한 유사 문장 판별" 한국컴퓨터교육학회 13 (13): 79-89, 2010

    5 김연어, "클래스 구조 그래프 비교를 통한 프로그램 표절 검사 방법" 한국콘텐츠학회 13 (13): 37-47, 2013

    6 김명철, "최신정보검색론" 홍릉과학출판사 2001

    7 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009

    8 천승환, "유사 어절트리와 비색인어 기반의 문서표절 유사도 분류 방법" 3 (3): 1039-1048, 2002

    9 조정현, "웹 검색을 활용한 기사 표절 탐지 시스템" 35 (35): 420-424, 2008

    10 장성호, "용어 선별기법에 의한 유사문서 판별시스템" 30 (30): 534-536, 2003

    1 조동욱, "효과적인 e-런닝 시스템 구축을 위한 과제물 표절 검사" 1 (1): 53-59, 2003

    2 류창건, "한글 말뭉치를 이용한 한글 표절 탐색 모델 개발" 한국정보과학회 14 (14): 231-235, 2008

    3 전명재, "한글 구조특성과 지역정렬 알고리즘을 사용한 표절 판정시스템의 개발" 31 (31): 727-729, 2004

    4 지혜성, "한국어 문장 표절 유형을 고려한 유사 문장 판별" 한국컴퓨터교육학회 13 (13): 79-89, 2010

    5 김연어, "클래스 구조 그래프 비교를 통한 프로그램 표절 검사 방법" 한국콘텐츠학회 13 (13): 37-47, 2013

    6 김명철, "최신정보검색론" 홍릉과학출판사 2001

    7 황인수, "인터넷 검색과 형태소분석을 이용한 표절검사시스템의 개발에 관한 연구" 한국데이타베이스학회 16 (16): 21-36, 2009

    8 천승환, "유사 어절트리와 비색인어 기반의 문서표절 유사도 분류 방법" 3 (3): 1039-1048, 2002

    9 조정현, "웹 검색을 활용한 기사 표절 탐지 시스템" 35 (35): 420-424, 2008

    10 장성호, "용어 선별기법에 의한 유사문서 판별시스템" 30 (30): 534-536, 2003

    11 지정훈, "바이트코드 분석을 이용한 자바 프로그램 표절검사기법" 한국정보과학회 35 (35): 442-451, 2008

    12 임해창, "문서의 표절 검사 방법"

    13 신미애, "문서구조정보기반의 유사도 측정" 18 (18): 499-502, 2010

    14 허원지, "문서간 유사도 측정방법의 개선에 관한 연구" 38 (38): 122-124, 2011

    15 김혜숙, "단어가중치기반 문서간유사도 측정에 관한 연구" 198-201, 2003

    16 박우창, "구조와 내용 유사도에 기반한 XML 웹문서 검색시스템 구축" 한국인터넷정보학회 6 (6): 99-115, 2005

    17 손기락, "계층적 군집화 기법을 이용한 소스 코드 표절 검사" 한국정보교육학회 11 (11): 91-98, 2007

    18 강원석, "검색엔진을 위한 키워드 관련어 추출기의 설계및 구현" 241-246, 2007

    19 "http://www.turnitin.com"

    20 김재훈, "KTAG99:새로운 환경에 쉽게 적응하는 한국어품사 태킹 시스템" 99-105, 1999

    21 S. M. Eissen, "IntrinsicPlagiarism Detection" 565-569, 2006

    22 S. Brin, "Copy DetectionMechanismsforDigitalDocuments" 398-409, 1995

    23 A. Si, "CHECK:A Document Plagiarism Detection System" 70-77, 1997

    24 국립국어연구원, "21세기 세종계획 성과물"

    더보기

    동일학술지(권/호) 다른 논문

    동일학술지 더보기

    더보기

    분석정보

    View

    상세정보조회

    0

    Usage

    원문다운로드

    0

    대출신청

    0

    복사신청

    0

    EDDS신청

    0

    동일 주제 내 활용도 TOP

    더보기

    주제

    연도별 연구동향

    연도별 활용동향

    연관논문

    연구자 네트워크맵

    공동연구자 (7)

    유사연구자 (20) 활용도상위20명

    인용정보 인용지수 설명보기

    학술지 이력

    학술지 이력
    연월일 이력구분 이력상세 등재구분
    2027 평가 재인증평가 신청대상 (재인증)
    2021-01-01 등재 등재학술지 유지 (재인증) KCI등재
    2018-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2015-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2011-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2008-01-01 등재 등재학술지 선정 (등재후보2차) KCI등재
    2007-05-04 학회명변경 영문명 : The Korea Contents Society -> The Korea Contents Association KCI등재후보
    2007-01-01 등재 등재후보 1차 PASS (등재후보1차) KCI등재후보
    2006-01-01 등재 등재후보학술지 유지 (등재후보1차) KCI등재후보
    2004-01-01 등재 등재후보학술지 선정 (신규평가) KCI등재후보
    더보기

    학술지 인용정보

    학술지 인용정보
    기준연도 WOS-KCI 통합IF(2년) KCIF(2년) KCIF(3년)
    2016 1.21 1.21 1.26
    KCIF(4년) KCIF(5년) 중심성지수(3년) 즉시성지수
    1.29 1.25 1.573 0.33
    더보기

    이 자료와 함께 이용한 RISS 자료

    나만을 위한 추천자료

    해외이동버튼