코퍼스언어학 연구는 크게 코퍼스 구축과 언어학적 분석의 두 단계로 이루어지고 주요 코퍼스를 선정하고 해당 전문 분야의 특수 코퍼스를 구축하는 것에서 시작된다. 러시아어의 경우 코...

http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=G3669850
2016년
Korean
한국연구재단(NRF)
0
상세조회0
다운로드코퍼스언어학 연구는 크게 코퍼스 구축과 언어학적 분석의 두 단계로 이루어지고 주요 코퍼스를 선정하고 해당 전문 분야의 특수 코퍼스를 구축하는 것에서 시작된다. 러시아어의 경우 코...
코퍼스언어학 연구는 크게 코퍼스 구축과 언어학적 분석의 두 단계로 이루어지고 주요 코퍼스를 선정하고 해당 전문 분야의 특수 코퍼스를 구축하는 것에서 시작된다. 러시아어의 경우 코퍼스의 종류가 그다지 다양하지 않으므로 본 연구의 주요 코퍼스는 러시아 국립 코퍼스가 될 것이다. 그리고 부차 코퍼스로 활용될 의료 분야의 특수 코퍼스를 구축하려는 시도부터 시작된다.
의료 코퍼스는 의사, 간호사, 의료 코디네이터 등 의료 분야에 종사하는 전문가들의 자문을 얻어, 해당 분야에서 자주 사용되고 인용되는 구어·문어 텍스트를 수집함으로써 확보될 수 있다. 의학 관련 교재 및 서식, 학술 논문, 대중매체 및 관련 기관 홈페이지 등에서 이러한 문서 텍스트가 수집되고, 해당 전문가가 제시하는 중요도에 따라 의료 코퍼스의 종류와 크기를 결정하게 될 것이다.
그 후 해당 텍스트를 컴퓨터가 읽을 수 있는 형식으로 변환하는 작업이 이루어진다. 이러한 작업은 텍스트를 전자문서 형식으로 변경하거나 전자문서로 이루어진 텍스트를 추출하는 작업을 통해 이루어진다. 이들은 다시 최근 코퍼스언어학 연구자들이 사용하는 콩코던서 등에 입력될 수 있도록 변환되고, 이러한 과정을 거쳐 만들어진 텍스트 파일은 코퍼스 내의 모든 어휘에 문법정보를 담는 과정인 태깅(tagging) 과정과 각 텍스트 파일의 헤드(head)에 메타정보를 입력하는 어노테이션(annotation)을 실시한 후 구축될 것이다.
다음 단계인 언어학적 분석에서는 구축된 코퍼스를 사용하여 어휘 목록을 작성하게 되고, 코퍼스에 사용된 전치사, 양상부사, 대명사 등과 같은 어휘의 빈도수와 이들과 공기(co-occur)하는 연어(collocation) 분석을 수행하게 된다. 더불어 코퍼스 내에 사용된 어휘에 대한 사용 어휘빈도수와 타임/토큰비율(Type/Token Ratio) 등을 통하여 의료 러시아어의 어휘 사용에 관한 개괄적 특징을 분석할 것이다.
의학 전문 용어의 어휘적 특징으로는 첫째, 여러 개의 단어로 이루어진 전문용어가 많이 나타난다는 점, 둘째, 많은 수의 약어 및 전문용어가 사용되며, 이러한 전문용어는 대부분 구어체에서는 거의 사용되지 않는 어휘에서 유래하고 많은 경우 지소형의 형태로 사용된다는 점, 셋째, 다수의 동의어 및 다의어가 존재한다는 점을 들 수 있다. 또한 해당 분야의 문체·통사적 특징으로는 형동사의 생산적 사용과 수동태, 부정인칭문의 높은 사용 빈도를 들 수 있다. 의료 분야에서 사용되는 러시아어의 이러한 어휘·통사·문체적 특징은 일반적인 러시아어 텍스트에서 사용되는 언어적 특징과 크게 구분되며 따라서 해당 분야의 전문적인 언어 연구뿐만 아니라 언어 학습, 언어 사용을 위해서는 일반적 언어 교육과 구분되는 특화된 방법론이 필요하다고 할 수 있다.
본 연구에서는 의료 분야 코퍼스를 통해 추출된 어휘를 바탕으로 어휘의 빈도, 연어 분석 등을 통한 결합 관계를 살펴봄으로써 일반 텍스트와 구분되는 특수 목적 텍스트 언어의 어휘적 특성을 연구한다. 또한 코퍼스를 기반으로 의료 분야 텍스트와 일반 텍스트에서 사용되는 전치사, 양상 부사와 같은 기능어와 어구 및 문장 유형을 비교, 분석함으로써 해당 분야 언어의 통사적·문체적 특성을 정의하여 일반 언어학적 연구뿐만 아니라 언어 교육, 학습과 같은 실용적 측면에서의 언어 연구에 기여하고자 한다.