국방부가 인공지능(Artificial Intelligence, AI) 기술을 기반으로 개발을 추진 하고 있는 AI 군사참모가 성공적으로 안착하기 위해서는 체계 구축의 핵심이 되는 사전 학습 언어 모델(Pre-trained Languag...

http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=T17374331
논산 : 국방대학교 국방대학교 국방관리대학원, 2026
학위논문(석사) -- 국방대학교 국방대학교 국방관리대학원 , 사이버전 , 2026. 2
2026
한국어
충청남도
; 26 cm
지도교수: 이수진
I804:11070-200000943383
0
상세조회0
다운로드국방부가 인공지능(Artificial Intelligence, AI) 기술을 기반으로 개발을 추진 하고 있는 AI 군사참모가 성공적으로 안착하기 위해서는 체계 구축의 핵심이 되는 사전 학습 언어 모델(Pre-trained Languag...
국방부가 인공지능(Artificial Intelligence, AI) 기술을 기반으로 개발을 추진 하고 있는 AI 군사참모가 성공적으로 안착하기 위해서는 체계 구축의 핵심이 되는 사전 학습 언어 모델(Pre-trained Language Model, PLM)에 대한 강건 성이 확보되어야 한다. 언어 모델의 강건성을 저해하는 가장 심각한 위협은 백도어 공격(Backdoor Attack)이다. 백도어 공격은 높은 은닉성을 기반으로 트리거가 아닌 입력에 대해서는 모델이 정상적으로 동작하기 때문에 탐지와 대응이 쉽지 않다. 이에 최근 들어서는 다양한 언어 모델들을 대상으로 백도어 공격에 대한 취약성을 규명하고 그에 대한 대응책을 모색하는 연구가 활발하게 진행되었다. 그러나 기존 연구의 대부분은 영어 기반 PLM을 대상으로 하고 있으며, 한국어 기반 PLM에 대한 연구는 찾아보기 어렵다. 이에 본 연구는 한국어 기반 PLM에 초점을 맞추는 백도어 공격에 대한 고유의 취약성을 실증적으로 규명하였다. 취약성 연구 대상으로는 대표적인 한국어 기반 PLM인 KoBERT(MLM)와 KoELECTRA(RTD) 모델을 선정했으며, 상이한 2종의 데이터세트(KLUE-TC, NSMC)를 대상으로 백도어 공격 실험을 설계하였다. 실험은 두 가지의 공격 시나리오를 통해 진행하였으며, 네 가지 핵심 변수가 취약성에 미치는 영향을 다각도로 검증하였다. 결론적으로 본 연구는 한국어 PLM이 ①사전 학습 방식, ②과업의 복잡성, ③트리거의 유형, ④트리거의 삽입 위치 등 다양한 공격 벡터 전반에 걸쳐 백 도어 공격에 근본적으로 취약함을 입증하였다. 이는 PLM의 확률적 패턴 암기 방식이 지름길 학습이나 위치 정보 악용과 같은 근본적인 보안 결함으로 이어 질 수 있음을 보여준다. 따라서 향후 ‘신뢰할 수 있는 AI기반 군사 시스템’ 확 보를 위하여, 데이터 필터링, 강건성 훈련 등 다층적 방어 전략에 대한 후속 연구가 시급하다.
목차 (Table of Contents)