RISS 학술연구정보서비스

검색

인기 검색어

    다국어 입력

    http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.

    변환된 중국어를 복사하여 사용하시면 됩니다.

    예시)
    • 中文 을 입력하시려면 zhongwen을 입력하시고 space를누르시면됩니다.
    • 北京 을 입력하시려면 beijing을 입력하시고 space를 누르시면 됩니다.
    닫기

    Data Optimization for Efficient Deep Learning = 효율적인 딥러닝을 위한 데이터 최적화

    한글로보기

    https://www.riss.kr/link?id=T17314555

    • 0

      상세조회
    • 0

      다운로드
    서지정보 열기
    • 내보내기
    • 내책장담기
    • 공유하기
    • 오류접수

    부가정보

    다국어 초록 (Multilingual Abstract) kakao i 다국어 번역

    Data serves as the foundation for how deep learning models perceive and predict reality by encapsulating real-world complexities. This dissertation investigates methods for optimizing data to enhance the learning effectiveness and inference efficiency of deep learning systems. Departing from conventional paradigms reliant on fixed-size benchmark datasets, our study introduces novel frameworks capable of generating, cleaning, and processing infinitely large amounts of data. Central to this research is the development of frameworks for co-optimizing data and models, enabling trained models to iteratively and autonomously enhance data processing in a self-reinforcing manner. Empirical evaluations across multiple domains—including visual image recognition, natural language processing, and speech processing—demonstrate the robustness and versatility of the proposed framework. The outcomes highlight significant improvements in learning performance and inference efficiency, underscoring the broad applicability and transformative potential of these techniques across industrial and scientific fields.
    번역하기

    Data serves as the foundation for how deep learning models perceive and predict reality by encapsulating real-world complexities. This dissertation investigates methods for optimizing data to enhance the learning effectiveness and inference efficiency...

    Data serves as the foundation for how deep learning models perceive and predict reality by encapsulating real-world complexities. This dissertation investigates methods for optimizing data to enhance the learning effectiveness and inference efficiency of deep learning systems. Departing from conventional paradigms reliant on fixed-size benchmark datasets, our study introduces novel frameworks capable of generating, cleaning, and processing infinitely large amounts of data. Central to this research is the development of frameworks for co-optimizing data and models, enabling trained models to iteratively and autonomously enhance data processing in a self-reinforcing manner. Empirical evaluations across multiple domains—including visual image recognition, natural language processing, and speech processing—demonstrate the robustness and versatility of the proposed framework. The outcomes highlight significant improvements in learning performance and inference efficiency, underscoring the broad applicability and transformative potential of these techniques across industrial and scientific fields.

    더보기

    국문 초록 (Abstract) kakao i 다국어 번역

    딥러닝은 계산 역량을 획기적으로 변화시켜 컴퓨터 비전, 자연어 처리, 음성 인식
    등 다양한 분야에서 혁신을 가능하게 했습니다 [142]. 엄선된 대규모 데이터셋으
    로 훈련된 ResNet과 GPT와 같은 대표적인 모델들은 이러한 놀라운 발전을 잘
    보여주며, 여러 작업에서 이전에 없던 높은 성능을 일관되게 달성하고 인간 수준
    이상의 정확도를 기록하고 있습니다 [60, 16].
    이러한 눈부신 발전에도 불구하고 최근 딥러닝 연구는 상당한 도전에 직면해
    있습니다. 특히, 딥러닝 모델들이 인터넷에서 얻을 수 있는 대부분의 고품질 데이
    터를 이미 소진함에 따라, 단순히 데이터 규모를 늘리는 방식의 성능 향상은 점점
    한계에 이르고 있습니다 [142]. 한편, 모델이 동적 상호작용을 통해 적응적으로
    학습하고, 전문적이고 데이터가 부족한 환경에서도 효과적으로 작동하는 새로운
    가능성이 등장하고 있습니다 [15]. 실시간으로 상호작용하는 AI 시스템과 고도로
    전문화된 산업 분야 등 이러한 새로운 응용 환경들은 기존 딥러닝 패러다임이
    제대로 대응하기 어려운 독특한 도전을 제기합니다.
    본 논문은 딥러닝 프레임워크에서 데이터가 가지는 핵심적 역할에 주목하여
    이러한 중대한 도전들을 체계적으로 다룹니다. 구체적으로, 제한된 라벨 데이터
    를 활용한 효과적인 모델 학습과 무한한 데이터 스트림을 효율적으로 처리하고
    활용하는 두 가지 주요 데이터 중심의 도전을 다룹니다. 이러한 문제를 극복하기
    위해 본 연구는 딥러닝 시스템의 효율성과 적응성을 모두 향상시키기 위해 특별히
    설계된 혁신적인 데이터 최적화 방법론을 제안합니다.
    본 연구의 핵심적인 기여 중 하나는 유익하고 고품질의 훈련 데이터를 생성하
    여 대규모 라벨 데이터셋 의존성을 완화하는 합성 데이터 생성 프레임워크입니다
    [91, 92]. 이에 더하여, 라벨 오류 및 이상치를 식별하고 수정하거나 제거함으로써
    훈련 데이터의 무결성과 신뢰성을 보장하는 종합적인 대규모 데이터 정제 프레임 워크를 소개합니다 [94]. 또한 Transformer 기반 아키텍처에 최적화된 고급 데이터
    압축 방법을 개발하여 온라인 상호작용과 메모리 사용 관리의 효율성을 크게 향상
    시킴으로써, 실시간으로 상호작용하는 실제 환경에서의 활용 가능성을 높였습니다
    [93, 97, 98].
    이러한 기여들은 데이터 개선이 직접적으로 모델 성능 향상을 촉진하고, 다시
    모델의 성능 향상이 데이터 최적화 전략을 더욱 정교하게 만드는 공동 최적화 프
    레임워크를 구성합니다. 이와 같은 반복적이고 자기 강화적인 순환 구조는 딥러닝
    모델이 제한된 라벨 데이터와 무한히 풍부한 데이터 스트림 모두를 효과적으로
    활용하여 강력한 학습과 추론을 가능케 합니다.
    본 연구를 통해 개발되고 실증적으로 검증된 방법론들은 실질적인 활용 가
    능성을 크게 높이는 동시에 의미 있는 이론적 통찰을 제공합니다. 기존 딥러닝
    프레임워크에 원칙에 기반한 확장을 제안함으로써 본 연구는 향후 연구를 위한 탄
    탄한 기초를 마련하며, 적응적이고 효율적이며 확장 가능한 딥러닝 시스템 개발을
    위한 새로운 연구 방향을 제시합니다.
    번역하기

    딥러닝은 계산 역량을 획기적으로 변화시켜 컴퓨터 비전, 자연어 처리, 음성 인식 등 다양한 분야에서 혁신을 가능하게 했습니다 [142]. 엄선된 대규모 데이터셋으 로 훈련된 ResNet과 GPT와 같...

    딥러닝은 계산 역량을 획기적으로 변화시켜 컴퓨터 비전, 자연어 처리, 음성 인식
    등 다양한 분야에서 혁신을 가능하게 했습니다 [142]. 엄선된 대규모 데이터셋으
    로 훈련된 ResNet과 GPT와 같은 대표적인 모델들은 이러한 놀라운 발전을 잘
    보여주며, 여러 작업에서 이전에 없던 높은 성능을 일관되게 달성하고 인간 수준
    이상의 정확도를 기록하고 있습니다 [60, 16].
    이러한 눈부신 발전에도 불구하고 최근 딥러닝 연구는 상당한 도전에 직면해
    있습니다. 특히, 딥러닝 모델들이 인터넷에서 얻을 수 있는 대부분의 고품질 데이
    터를 이미 소진함에 따라, 단순히 데이터 규모를 늘리는 방식의 성능 향상은 점점
    한계에 이르고 있습니다 [142]. 한편, 모델이 동적 상호작용을 통해 적응적으로
    학습하고, 전문적이고 데이터가 부족한 환경에서도 효과적으로 작동하는 새로운
    가능성이 등장하고 있습니다 [15]. 실시간으로 상호작용하는 AI 시스템과 고도로
    전문화된 산업 분야 등 이러한 새로운 응용 환경들은 기존 딥러닝 패러다임이
    제대로 대응하기 어려운 독특한 도전을 제기합니다.
    본 논문은 딥러닝 프레임워크에서 데이터가 가지는 핵심적 역할에 주목하여
    이러한 중대한 도전들을 체계적으로 다룹니다. 구체적으로, 제한된 라벨 데이터
    를 활용한 효과적인 모델 학습과 무한한 데이터 스트림을 효율적으로 처리하고
    활용하는 두 가지 주요 데이터 중심의 도전을 다룹니다. 이러한 문제를 극복하기
    위해 본 연구는 딥러닝 시스템의 효율성과 적응성을 모두 향상시키기 위해 특별히
    설계된 혁신적인 데이터 최적화 방법론을 제안합니다.
    본 연구의 핵심적인 기여 중 하나는 유익하고 고품질의 훈련 데이터를 생성하
    여 대규모 라벨 데이터셋 의존성을 완화하는 합성 데이터 생성 프레임워크입니다
    [91, 92]. 이에 더하여, 라벨 오류 및 이상치를 식별하고 수정하거나 제거함으로써
    훈련 데이터의 무결성과 신뢰성을 보장하는 종합적인 대규모 데이터 정제 프레임 워크를 소개합니다 [94]. 또한 Transformer 기반 아키텍처에 최적화된 고급 데이터
    압축 방법을 개발하여 온라인 상호작용과 메모리 사용 관리의 효율성을 크게 향상
    시킴으로써, 실시간으로 상호작용하는 실제 환경에서의 활용 가능성을 높였습니다
    [93, 97, 98].
    이러한 기여들은 데이터 개선이 직접적으로 모델 성능 향상을 촉진하고, 다시
    모델의 성능 향상이 데이터 최적화 전략을 더욱 정교하게 만드는 공동 최적화 프
    레임워크를 구성합니다. 이와 같은 반복적이고 자기 강화적인 순환 구조는 딥러닝
    모델이 제한된 라벨 데이터와 무한히 풍부한 데이터 스트림 모두를 효과적으로
    활용하여 강력한 학습과 추론을 가능케 합니다.
    본 연구를 통해 개발되고 실증적으로 검증된 방법론들은 실질적인 활용 가
    능성을 크게 높이는 동시에 의미 있는 이론적 통찰을 제공합니다. 기존 딥러닝
    프레임워크에 원칙에 기반한 확장을 제안함으로써 본 연구는 향후 연구를 위한 탄
    탄한 기초를 마련하며, 적응적이고 효율적이며 확장 가능한 딥러닝 시스템 개발을
    위한 새로운 연구 방향을 제시합니다.

    더보기

    목차 (Table of Contents)

    • Chapter 1. Introduction (p.1)
    • Chapter 2. Preliminary (p.4)
    • Chapter 3. Puzzle Mix: Exploiting Saliency and Local Statistics for Optimal Mixup (p.8)
    • Chapter 4. Co-Mixup: Saliency Guided Joint Mixup with Supermodular Diversity (p.28)
    • Chapter 5. Neural Relation Graph: A Unified Framework for Identifying Label Noise and Outlier Data (p.42)
    • Chapter 1. Introduction (p.1)
    • Chapter 2. Preliminary (p.4)
    • Chapter 3. Puzzle Mix: Exploiting Saliency and Local Statistics for Optimal Mixup (p.8)
    • Chapter 4. Co-Mixup: Saliency Guided Joint Mixup with Supermodular Diversity (p.28)
    • Chapter 5. Neural Relation Graph: A Unified Framework for Identifying Label Noise and Outlier Data (p.42)
    • Chapter 6. Dataset Condensation via Efficient Synthetic-Data Parameterization (p.63)
    • Chapter 7. Compressed Context Memory For Online Language Model Interaction (p.82)
    • Chapter 8. KVzip: Query-Agnostic KV Cache Compression with Context Reconstruction (p.102)
    • Chapter 9. Conclusion (p.118)
    • Acknowledgements (p.140)
    • 요약 (p.141)
    더보기

    분석정보

    View

    상세정보조회

    0

    Usage

    원문다운로드

    0

    대출신청

    0

    복사신청

    0

    EDDS신청

    0

    동일 주제 내 활용도 TOP

    더보기

    주제

    연도별 연구동향

    연도별 활용동향

    연관논문

    연구자 네트워크맵

    공동연구자 (7)

    유사연구자 (20) 활용도상위20명

    이 자료와 함께 이용한 RISS 자료

    나만을 위한 추천자료

    해외이동버튼