최근 인공지능(AI) 기술의 발전은 민간 분야를 넘어 군사 영역으로 빠르게 확산되고 있으며, 특히 지휘관의 의사결정을 보조하거나 자동화하는 기술의 중요성이 크게 대두되고 있다. 이러한 ...

http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=T17374451
논산 : 국방대학교 국방대학교 국방관리대학원, 2026
학위논문(석사) -- 국방대학교 국방대학교 국방관리대학원 , 컴퓨터공학 컴퓨터공학 , 2026. 2
2026
한국어
충청남도
59 ; 26 cm
지도교수: 김인영
I804:11070-200000940816
0
상세조회0
다운로드최근 인공지능(AI) 기술의 발전은 민간 분야를 넘어 군사 영역으로 빠르게 확산되고 있으며, 특히 지휘관의 의사결정을 보조하거나 자동화하는 기술의 중요성이 크게 대두되고 있다. 이러한 ...
최근 인공지능(AI) 기술의 발전은 민간 분야를 넘어 군사 영역으로 빠르게 확산되고 있으며, 특히 지휘관의 의사결정을 보조하거나 자동화하는 기술의 중요성이 크게 대두되고 있다. 이러한 추세 속에서 복잡하고 불확실한 전장 환경에서 제한된 자원을 효율적으로 운용하기 위한 무기–표적 할당(Weapon –Target Assignment, WTA) 문제가 군사작전 연구의 핵심 과제로 부상하고 있다. WTA는 전투 효과의 극대화를 목표로, 여러 무기와 다수의 표적 간 최 적의 교전 관계를 결정하는 복잡한 조합 최적화 문제이다. 본 연구는 1980∼2025년대 발표된 국내·외 주요 WTA 관련 연구를 체계적 으로 분석하여 연구의 기술적 흐름과 발전 양상을 고찰하고, 나아가 심층 강 화학습(Deep Reinforcement Learning, DRL) 기반의 WTA 모델을 구현하여 실제 전장 환경을 반영한 실험적 검증을 수행하였다. 문헌 분석 결과, 2000년 대까지는 정수계획법(MILP), 동적계획법(DP) 등 정확해법(Exact methods) 중 심의 연구가 주를 이루었으며, 2010년대에는 유전 알고리즘(GA), 개미군집최 적화(ACO), 입자군집최적화(PSO) 등 메타휴리스틱 기법이 활발히 적용되었 다. 최근에는 DQN, DDPG, PPO 등 강화학습 기반 접근법이 등장하며, 복잡 한 전장 환경의 동적 의사결정 문제를 해결하기 위한 실시간 학습형 WTA 모델이 개발되고 있다. 본 논문에서는 DQN(Deep Q-Network) 알고리즘을 활용하여 전장 환경의 변동성, 표적의 위협도, 공산오차(Circular Error Probable, CEP), 작전구역 제 약 등을 반영한 WTA 모델을 구축하였다. 모델의 성능은 기존의 휴리스틱 기 반 접근(Greedy)과 비교하여 평가되었으며, 그 결과 강화학습 기반 접근이 성 공률, 학습 안정성 측면에서 우수한 결과를 보였다. 본 연구의 의의는 WTA 연구의 시대별·기술별 발전 동향을 정리함과 동시 에, 강화학습을 활용한 동적 의사결정 모델의 실험적 가능성을 제시한 데 있 다. 이를 통해 향후 인공지능 기반 지휘결심 지원 체계의 발전에 기여할 수 있는 기초자료를 제공하고자 한다. 주요어: 무기–표적 할당, 심층 강화 학습, DQN, 공산오차, 작전구역 제약
목차 (Table of Contents)