RISS 학술연구정보서비스

검색

인기 검색어

    다국어 입력

    http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.

    변환된 중국어를 복사하여 사용하시면 됩니다.

    예시)
    • 中文 을 입력하시려면 zhongwen을 입력하시고 space를누르시면됩니다.
    • 北京 을 입력하시려면 beijing을 입력하시고 space를 누르시면 됩니다.
    닫기
    KCI등재

    자연언어 텍스트의 토큰 및 문장 경계의 자동 인식 문제에 대한 논의 = PROBLEMES DE RECONNAISSANCE AUTOMATIQUE DES UNITES LEXICALES ET DES PHRASES

    한글로보기

    https://www.riss.kr/link?id=A104673354

    • 0

      상세조회
    • 0

      다운로드
    서지정보 열기
    • 내보내기
    • 내책장담기
    • 공유하기
    • 오류접수

    부가정보

    다국어 초록 (Multilingual Abstract) kakao i 다국어 번역

    Dans cet article, nous avons essayé de montrer certains problèmes de reconnaissance automatique des unités lexicales(tokens) et des phrases dans les textes en langues naturelles, notamment en anglais, en français et en coréen. Bien que le découpage des textes soit une tâche préliminaire dans tous les systèmes de l'analyse automatique, les difficultés dans cette tâche est fortement liées aux aspects spécifiques de chaque langue. Dans un premier temps, nous avons examiné les particularités des ponctuations en anglais, surtout de celles qui causent des erreurs du découpage. Ensuite, nous avons analysé les aspects particuliers des usages des ponctuations en français et enfin, les notions problématiques des unités lexicales en coréen ont été examinées. Pour pouvoir réaliser un système de découpage automatique des textes pour une langue donnée, il sera indispensable de comprendre ses caractéristiques linguistiques et de décrire de façon exhaustive et systématique les contraintes et les conditions des contextes des unités lexicales et des phrases.
    번역하기

    Dans cet article, nous avons essayé de montrer certains problèmes de reconnaissance automatique des unités lexicales(tokens) et des phrases dans les textes en langues naturelles, notamment en anglais, en français et en coréen. Bien que le découp...

    Dans cet article, nous avons essayé de montrer certains problèmes de reconnaissance automatique des unités lexicales(tokens) et des phrases dans les textes en langues naturelles, notamment en anglais, en français et en coréen. Bien que le découpage des textes soit une tâche préliminaire dans tous les systèmes de l'analyse automatique, les difficultés dans cette tâche est fortement liées aux aspects spécifiques de chaque langue. Dans un premier temps, nous avons examiné les particularités des ponctuations en anglais, surtout de celles qui causent des erreurs du découpage. Ensuite, nous avons analysé les aspects particuliers des usages des ponctuations en français et enfin, les notions problématiques des unités lexicales en coréen ont été examinées. Pour pouvoir réaliser un système de découpage automatique des textes pour une langue donnée, il sera indispensable de comprendre ses caractéristiques linguistiques et de décrire de façon exhaustive et systématique les contraintes et les conditions des contextes des unités lexicales et des phrases.

    더보기

    참고문헌 (Reference)

    1 김강수, "한글 문장부호의 조판 관행에 대하여" 1 (1): 2007

    2 이경호, "자연언어 처리와 문장 부호" 국제어문학회 24 : 2001

    3 박수혁, "기계 학습 기법을 이용한 문장경계인식" 2008

    4 이승후, "국어 문장부호 연구" 명지대학교 2003

    5 Grefenstette, Gregory, "What is a word, what is a sentence? Problems of Tokenisation" 1994

    6 Habert, Benoit, "Towards Tokenization Evaluation. In Proceedings of the 1st International Conference on Language Resources and Evaluation(LREC)" 1998

    7 Lemnitzer, Lothar, "Tokenization" Eberhard Karls Universitat Tubingen 2003

    8 Molla, Diego, "Tokenisation and Sentence Segmentation" 2007

    9 Gross, Maurice, "The Construction of Local Grammars in: Finite-State Language Processing" MIT Press 1997

    10 Mikheev, Andrei, "Text Segmentation in The Oxford Handbook of Computational Linguistics" Oxford University Press 2003

    1 김강수, "한글 문장부호의 조판 관행에 대하여" 1 (1): 2007

    2 이경호, "자연언어 처리와 문장 부호" 국제어문학회 24 : 2001

    3 박수혁, "기계 학습 기법을 이용한 문장경계인식" 2008

    4 이승후, "국어 문장부호 연구" 명지대학교 2003

    5 Grefenstette, Gregory, "What is a word, what is a sentence? Problems of Tokenisation" 1994

    6 Habert, Benoit, "Towards Tokenization Evaluation. In Proceedings of the 1st International Conference on Language Resources and Evaluation(LREC)" 1998

    7 Lemnitzer, Lothar, "Tokenization" Eberhard Karls Universitat Tubingen 2003

    8 Molla, Diego, "Tokenisation and Sentence Segmentation" 2007

    9 Gross, Maurice, "The Construction of Local Grammars in: Finite-State Language Processing" MIT Press 1997

    10 Mikheev, Andrei, "Text Segmentation in The Oxford Handbook of Computational Linguistics" Oxford University Press 2003

    11 Mikheev, Andrei, "Tagging Sentence Boundaries" 2000

    12 Heitz. Thomas, "Modélisation du prétraitement des textes" 2006

    13 Fuchs. Catherine, "Linguistique et Traitement automatique des langues" Hachette 1993

    14 Erjavec. Tomaz, "Language Technologies" Jozef Stefan International Postgraduate School 2008

    15 Mourad. Ghassan, "La segmentation de textes par l'étude de la ponctuation" 1999

    16 Schulte im Walde, Sabine, "Introduction to Corpus Rescouces, Annotation and Access: Tokenisation" Universitat Stuttgart 2007

    17 Roche, Emmanuel, "Finite-State Language Processing" The MIT Press 1997

    18 Silberztein, Max, "Dictionnaire électronique et analyse automatique de textes. Le système INTEX" Masson 1993

    19 Paumier, Sebastien, "De la reconnaissance de formes linguistiques à l'analyse syntaxique" University of Marne-la-Vallée 2003

    20 Gardent. Claire, "Corpus Processing and Tokenizing with NLTK" CNRS/ LORIA 2007

    21 Friburger, Nathalie, "Améliorer la reconnaissance automatique des fins de phrases" 36 : 2000

    더보기

    동일학술지(권/호) 다른 논문

    분석정보

    View

    상세정보조회

    0

    Usage

    원문다운로드

    0

    대출신청

    0

    복사신청

    0

    EDDS신청

    0

    동일 주제 내 활용도 TOP

    더보기

    주제

    연도별 연구동향

    연도별 활용동향

    연관논문

    연구자 네트워크맵

    공동연구자 (7)

    유사연구자 (20) 활용도상위20명

    인용정보 인용지수 설명보기

    학술지 이력

    학술지 이력
    연월일 이력구분 이력상세 등재구분
    2026 평가 재인증평가 신청대상 (재인증)
    2020-01-01 등재 등재학술지 유지 (재인증) KCI등재
    2017-01-01 등재 등재학술지 유지 (계속평가) KCI등재
    2013-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2010-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2008-01-01 등재 등재학술지 유지 (등재유지) KCI등재
    2005-01-01 등재 등재학술지 선정 (등재후보2차) KCI등재
    2004-01-01 등재 등재후보 1차 PASS (등재후보1차) KCI등재후보
    2002-01-01 등재 등재후보학술지 선정 (신규평가) KCI등재후보
    더보기

    학술지 인용정보

    학술지 인용정보
    기준연도 WOS-KCI 통합IF(2년) KCIF(2년) KCIF(3년)
    2016 0.33 0.33 0.29
    KCIF(4년) KCIF(5년) 중심성지수(3년) 즉시성지수
    0.28 0.24 0.516 0.05
    더보기

    이 자료와 함께 이용한 RISS 자료

    나만을 위한 추천자료

    해외이동버튼