← 최신 논문
💻 computer science

CKAA: Cross-subspace Knowledge Alignment and Aggregation for Robust Continual Learning

본 논문은 서브스페이스 전반의 특징 분포를 통일하기 위한 이중 수준 지식 정렬(Dual-level Knowledge Alignment)과 추론 시 지식을 적응적으로 결합하기 위한 태스크 신뢰도 유도 혼합 어댑터(Task-Confidence-guided Mixture of Adapters)를 채택하여 오도하는 태스크 식별자에 대한 강건성을 향상시키는 새로운 지속 학습 프레임워크인 CKAA를 제안한다.

원저자: Lingfeng He, De Cheng, Zhiheng Ma, Huaijie Wang, Dingwen Zhang, Nannan Wang, Xinbo Gao

게시일 2026-08-20
📖 3 분 읽기☕ 가벼운 읽기

원저자: Lingfeng He, De Cheng, Zhiheng Ma, Huaijie Wang, Dingwen Zhang, Nannan Wang, Xinbo Gao

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

인공지능이 학습을 멈추지 않는 세상을 상상해 보십시오. 고정된 데이터 세트로 한 번 학습된 후 시간에 멈춰 있는 대신, 이 시스템들은 인간처럼 새로운 정보를 지속적으로 흡수하고 새로운 범주와 변화하는 환경에 적응합니다. '연속 학습(continual learning)'이라고 알려진 이 개념은 새로운 도전과 데이터 스트림이 끊임없이 도착하는 현실 세계를 항해할 수 있는 AI를 구축하는 데 필수적입니다. 하지만 여기에는 중대한 장애물이 있습니다. 모델이 새로운 것을 배울 때, 이전에 배웠던 것을 인식하는 능력을 상실하게 되는 '파괴적 망각(catastrophic forgetting)' 현상을 자주 겪는다는 점입니다. 이를 해결하기 위해 연구자들은 '매개변수 효율적 미세 조정(parameter-efficient fine-tuning)'이라는 전략에 주목했습니다. AI 모델의 거대한 뇌 전체를 다시 학습시키는 것은 느리고 비용이 많이 들기 때문에, 대신 사전 학습된 핵심 구조에 작고 전문화된 부가 장치들을 부착하는 방식입니다. 각 새로운 작업에는 자신만의 아주 작은 모듈이 할당되어, 시스템이 과거의 지식을 덮어쓰지 않고도 학습할 수 있게 합니다.

문제는 AI가 나중에 이 지식을 사용하려고 할 때 발생합니다. 많은 현실 세계의 시나리오에서 시스템은 자신이 직면한 구체적인 작업이 무엇인지 알지 못하며, 추측해야만 합니다. 만약 AI가 잘못 추측하여 사진에 대해 잘못된 전문 부가 장치를 사용하게 되면, 그 결과는 종종 혼란스럽고 부정확한 답변으로 이어집니다. 이는 각 부가 장치가 고립된 상태로 학습되어, 특징을 이해하는 자신만의 고유한 내부 언어나 '서브스페이스(subspace)'를 생성했기 때문입니다. 사진이 잘못된 서브스페이스로 강제 투입되면, 특징들이 어긋나게 되어 모델은 이를 제대로 이해할 수 없게 됩니다. 이에 한 연구팀은 이러한 혼란을 해결하고 이러한 학습 시스템을 실수에 훨씬 더 강력하게 만들기 위해 설계된 '교차 서브스페이스 지식 정렬 및 집합(Cross-subspace Knowledge Alignment and Aggregation, CKAA)'이라는 새로운 프레임워크를 개발했습니다.

연구진은 핵심적인 문제가 이 고립된 부가 장치들 사이의 조화가 부족하다는 점임을 파악했습니다. 어떤 카테고리의 사진이 실수로 다른 카테고리를 위해 학습된 모듈으로 전달되었을 때, 그 사진의 내부 표현은 엉망이 되어 모호한 결정을 초래했습니다. 이를 해결하기 위해 연구팀은 서로 다른 렌즈를 통해 동일한 사물을 바라보더라도, 이 별개의 모듈들이 특징의 의미에 대해 합의하도록 강제하는 학습 방법을 도입했습니다. 그들은 서로 다른 모듈이 동일한 클래스의 객체를 보는 방식을 정렬하여, '개'라는 객체가 개를 위한 모듈에 의해 처리되든 고양이를 위한 모듈에 의해 처리되든 의미론적으로 유사하게 보이도록 보장하는 과정을 만들었습니다. 나아가, 시스템이 자신이 잘못된 렌즈를 통해 사진을 보고 있을 수도 있다는 점을 인식하고 그에 따라 의사 결정 경계를 조정하도록 가르쳤습니다. 여기에는 특정 사진이 잘못된 모듈에 의해 처리된다면 어떤 모습일지를 시뮬레이션하고, 그럼에도 불구하고 이를 올바르게 식별하도록 시스템을 학습시키는 과정이 포함됩니다. 이를 통해 모델은 올바른 경로와 잘못된 경로를 구분하는 법을 배우며, 결과적으로 자신의 오류에 대한 안전망을 효과적으로 구축하게 됩니다.

테스트 단계에서 연구진은 사전에 작업을 알 수 없는 불확실성을 다루기 위해 동적인 전략을 구현했습니다. AI가 단 하나의 모듈을 선택해 고수하도록 강요하는 대신, 이 시스템은 가능한 모든 작업에 대해 신뢰도 점수를 계산합니다. 그런 다음 관련 있는 여러 모듈의 통찰력을 추출하여, 그것이 정답일 가능성에 따라 가중치를 두어 부드럽게 혼합합니다. 이러한 접근 방식은 모델이 잘못된 추측에 대해 과도하게 확신하는 것을 방지합니다. 만약 시스템이 확신하지 못한다면, 단 하나의 잠재적으로 결함이 있는 경로에 의존하는 대신 지식의 혼합물을 끌어다 씁니다. 이러한 '소프트 집합(soft aggregation)' 방식은 AI가 오인식으로부터 회복할 수 있게 하여, 초기 작업 식별이 틀렸을 때도 높은 정확도를 유지하게 해줍니다.

수천 개의 카테고리를 포함한 복잡한 이미지 데이터셋을 포함한 4개의 주요 벤치마크에 대한 광범한 테스트 결과, 이 접근 방식의 효과가 입증되었습니다. 새로운 프레임워크는 기존 방법들을 일관되게 능가하며, 단기 및 장기 학습 시나리오 모두에서 더 높은 정확도를 달anim했습니다. 어렵고 불균형한 샘플이 포함된 까다로운 데이터셋을 이용한 한 테스트에서, 이 새로운 방법은 이전의 최고 기술들보다 상당한 차이로 정확도를 개선했습니다. 또한 연구진은 이 시스템이 실질적인 신뢰도 향상을 제공하면서도 계산 비용을 아주 적게 추가하는 효율적인 시스템임을 입증했습니다. 서로 다른 학습 모듈 간의 내부 언어를 정렬하고 지식을 결합하는 유연한 방법을 만듦으로써, 이 연구는 자신의 실수에 쉽게 혼란에 빠지지 않으면서도 지속적으로 학습할 수 있는 인공지능을 향한 유망한 진전을 제시합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →