음성인식은 사람의 말소리를 컴퓨터로 처리하여 문자로 변환하는 기술로써 스마트폰, 내비게이션, 컴퓨터 등 다양한 장치에서 활용되고 있다. 최근에는 다수의 연산 코어를 탑재한 멀티 코...

http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=T13383809
서울 : 高麗大學校 大學院, 2014
學位論文(碩士) -- 高麗大學校 大學院 , 컴퓨터·電波通信工學科 컴퓨터學專攻 , 2014. 2
2014
한국어
서울
ix, 69장 : 삽화, 도표 ; 26 cm
지도교수: 陸東錫
참고문헌: 장 68-69
0
상세조회0
다운로드음성인식은 사람의 말소리를 컴퓨터로 처리하여 문자로 변환하는 기술로써 스마트폰, 내비게이션, 컴퓨터 등 다양한 장치에서 활용되고 있다. 최근에는 다수의 연산 코어를 탑재한 멀티 코...
음성인식은 사람의 말소리를 컴퓨터로 처리하여 문자로 변환하는 기술로써 스마트폰, 내비게이션, 컴퓨터 등 다양한 장치에서 활용되고 있다. 최근에는 다수의 연산 코어를 탑재한 멀티 코어 프로세서가 널리 보급되어 스마트폰과 같은 휴대용 장치에도 멀티 코어가 탑재되는 것이 보편적이다. 이러한 멀티 코어의 성능을 활용하기 위해서는 병렬 처리 알고리즘이 필수적이나 기존의 음성 인식 알고리즘은 병렬 처리에 적합하지 않아 바로 병렬화가 어려운 문제가 있다.
일반적인 음성 인식은 hidden Markov model (HMM) 으로 음성 특성을 모델링하고, Viterbi 알고리즘을 이용하여 음성 인식을 수행하는 형태로 이루어진다. Viterbi 알고리즘은 특성상 주어진 입력 데이터를 끝까지 처리한 후에야 back-trace 라 불리우는 단계를 통하여 최종 결과를 얻게 된다. 범용적인 Viterbi 알고리즘의 경우 주어진 입력 데이터를 임의로 구간을 분할하여 구간별로 처리한 후 back-trace 한 결과를 나중에 합친 것과, 전체를 끝까지 처리한 후 back-trace 한 결과는 확연하게 다르다. 그러나 음성 인식의 경우는 도메인의 특성상 분할하여 back-trace 하더라도 구간을 분할한 경계면에 에러가 집중되고, 나머지 부분의 결과는 분할하지 않고 전체를 처리하였을 때와 유사하게 나타나는 특성이 있다. 따라서 본 논문에서는 이러한 특성을 이용하여 입력된 소리 신호를 적당한 크기로 분할하여 병렬로 계산한 후, 에러가 집중되는 경계면 부분의 결과를 보정 처리하여 정확도를 유지하며 병렬로 Viterbi 알고리즘을 계산하는 방법을 제안한다.
본 논문에서는 먼저 입력된 음성 신호를 병렬 처리를 위하여 적당한 길이로 분할한다. 이 때, 분할 경계면의 오류 보정을 위하여 분할 구간이 서로 일정 길이만큼 겹치도록 하는 overlap frame 방식으로 신호를 분할한다. 이와 같이 나누어진 신호를 각각의 연산 코어에 할당하여 독립적으로 Viterbi 알고리즘을 수행한다. 이후 경계면의 오류 보정을 위하여 추가된 overlap frame 부분의 인식 결과를 dynamic time warping (DTW) 알고리즘을 통하여 정렬한 후, 최종 결과를 병합하여 오류를 보정하는 방법을 이용하였다. 실험에서는 overlap frame 의 길이에 따라서 기존의 단일 코어용 Viterbi 알고리즘과 비교하여 인식 정확도와 수행 속도가 얼마나 차이나는 지를 확인하였다.
목차 (Table of Contents)