← 최신 논문
🤖 machine learning

Coverage You Can Steer: Online Conformal Calibration for RL-Driven Hardware-Aware NAS

본 논문은 강화 학습 기반의 하드웨어 인지 신경망 구조 탐색 과정의 비교환적 특성에도 불구하고, 정확도를 희생하거나 목표 오차율을 위반하지 않으면서 후보 구조의 25~50%를 효율적으로 프루닝할 수 있도록 적응형 피드백 제어를 사용하여 분포 불변 보장을 복구하는 온라인 컨포멀 캘리브레이션 프레임워크를 제안한다.

원저자: Pedro Brandimarte, Nerea Aranjuelo, Marcos Nieto, Oihana Otaegui

게시일 2026-10-05✓ Author reviewed ⓘ
📖 5 분 읽기🧠 심층 분석

원저자: Pedro Brandimarte, Nerea Aranjuelo, Marcos Nieto, Oihana Otaegui

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. ✨ 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

스마트워치, 자동차의 브레이크 시스템, 또는 의료용 센서 안에 들어있는 아주 작은 컴퓨터들이 현재 거대한 데이터 센터에서만 구동되는 강력한 인공지능을 실행할 수 있는 세상을 상상해 보십시오. 이것이 바로 에지 AI(edge AI)가 약속하는 미래입니다. 즉, 개인 데이터를 클라우드로 다시 보낼 필요 없이 로컬에서 즉각적으로 작동하는 지능형 시스템입니다. 하지만 여기에는 문제가 있습니다. 이러한 에지 기기들은 메모리 용량과 정보 처리 속도에 매우 엄격한 제한을 가지고 있습니다. 이러한 타이트한 제약 조건에 맞춰 신경망(데이터로부터 학습하는 일종의 컴퓨터 프로그램)을 설계하는 것은, 마치 거대한 마천루를 지어야 하는데 그 건물이 반드시 신발 상자 안에 들어가야 하는 것과 같습니다. 층(layer), 연결, 설정의 조합이 수백만 가지에 달하는 데다 그 경우의 수가 너무나 방대하기 때문에, 인간 설계자가 이를 모두 테스트하는 것은 불가능합니다.

이를 해결하기 위해 연구자들은 컴퓨터 프로그램이 최적의 설계를 찾기 위해 다양한 설계를 자동으로 시도하는 '신경 구조 탐색(neural architecture search)'이라는 방법을 사용합니다. 그러나 단 하나의 설계를 테스트하는 것조차 엄청나게 비용이 많이 들고 느린 작업입니다. 모델이 얼마나 잘 작동하는지 확인하기 위해 데이터로 모델을 훈련시켜야 하기 때문입니다. 만약 컴퓨터가 단 하나의 좋은 설계를 찾기 위해 수천 개의 설계를 훈련시켜야 한다면, 그 과정은 실용적이지 못할 정도로 비용이 과다해집니다. 따라서 과제는 어떤 설계가 시간과 돈을 들여 훈련할 가치가 있는지, 그리고 어떤 설계를 전체 테스트를 거치지 않고 즉시 폐기해야 하는지를 결정하는 것입니다.

스페인의 비코무텍(Vicomtech) 연구팀은 이 필터링 과정을 신뢰할 수 있게 만드는 새로운 방법을 개발했습니다. 그들은 이전의 시도들을 조용히 저해해 온 문제, 즉 컴퓨터의 학습 과정 자체가 게임의 규칙을 바꾸고 있었던 문제를 해결했습니다. 이러한 탐색 시스템에서는 '컨트롤러'가 지금까지 학습한 내용을 바탕으로 새로운 설계를 제안합니다. 컨트롤러가 똑똑해짐에 따라 그가 제안하는 설계도 변하게 됩니다. 기존의 방식들은 탐색 초기 단계에서 제안된 설계들이 탐색 마지막 단계에서 제안되는 설계들과 통계적으로 유사할 것이라고 가정하고 설계를 걸러냈습니다. 하지만 컨트롤러가 학습하고 개선됨에 따라 이 가정은 거짓이 됩니다. 설계는 계속해서 변화하며, 초기 설계에 맞춰 조정되었던 기존의 필터들은 실패하기 시작했습니다. 이 필터들은 형편없는 설계를 훈련하느라 시간을 낭비하거나, 더 심하게는, 제대로 테스트되기도 전에 단 하나의 가장 좋은 설계를 실수로 버려버리기도 했습니다.

연구진은 이 정적인 일회성 필터를 실시간으로 학습하고 조정되는 시스템으로 교체했습니다. 규칙을 한 번 설정하고 그것이 유지되기를 바라는 대신, 그들의 새로운 방법은 자신의 성능을 지속적으로 확인하는 피드로백 루프를 사용합니다. 설계가 테스트될 때마다 시스템은 다음과 같이 자문합니다. "나는 이 설계가 좋을지 나쁠지 제대로 예측했는가?" 만약 시스템이 실수를 했다면, 내부적인 '좋은 설계'의 기준치를 미세하게 조정합니다. 이 조정은 지속적으로 일어나며, 이를 통해 시스템은 변화하는 탐색의 본질을 추적할 수 있습니다. 그 결과, 조절 가능한 수준의 안전성을 갖춘 필터가 탄생했습니다. 만약 연구자가 좋은 설계를 놓치지 않을 확률 90%의 보장을 요구한다면, 시스템은 탐색이 어떻게 진화하든 상관없이 정확히 그 수치를 제공합니다. 95%를 요구하면 95%를 제공합니다. 이 제어는 정밀하고 재현 가능하며, 제안되는 설계가 급격하게 변하는 상황에서도 작동합니다.

연구팀은 이 접근 방식을 세 가지 다른 유형의 네트워크 구조와 다양한 데이터셋에 걸쳐 테스트하여, 매우 제한된 메모리를 가진 마이크로컨트롤러에서 실행될 수 있는 모델을 찾는 과정을 시뮬레이션했습니다. 그들은 이 적응형 시스템이 제안된 설계 중 25%에서 50% 사이를 훈련 없이도 안전하게 폐기할 수 있음을 발견했으며, 이를 통해 막대한 컴퓨팅 시간을 절약했습니다. 결정적으로, 이러한 가지치기는 최종 솔루션의 품질을 해치지 않았습니다. 실제로, 최적의 설계가 평범한 옵션들이 즐비한 광활한 풍경 속에서 드물고 고립된 정점(peak)이었던 특정 테스트 케이스에서, 기존 방식들은 반복적으로 실패하며 최적의 설계를 버렸습니다. 반면, 새로운 적응형 방식은 매번 최적의 설계를 찾아냈습니다.

연구진은 또한 이러한 설계를 생성하기 위해 흔히 사용되는 '스마트'한 컨트롤러가 사실 최적의 구조를 찾는 데 가장 효율적인 방법은 아니라는 점도 발견했습니다. 정교한 학습형 컨트롤러와 단순한 무작위 탐색(random search)을 비교했을 때, 많은 경우에서 무작위 탐색이 대등하거나 오히려 더 나은 성능을 보였습니다. 컨트롤러는 평균적인 설계들을 찾는 데는 유능했지만, 국소적인 영역에 갇혀 드물고 완벽한 설계를 놓치는 경향이 있었습니다. 그들이 발견한 이 방법의 진정한 가치는 컨트롤러 자체에 있는 것이 아니라, 예산을 관리하는 '보정된 필터'에 있었습니다. 연구진은 적응형 필터를 단순히 문지기가 아닌, 다음에 어디를 찾아봐야 할지를 알려주는 가이드로 활용함으로써 탐색을 최적의 솔루션으로 직접 유도할 수 있었습니다. 이 '보정된 낙관주의(calibrated optimism)'를 통해 시스템은 알려진 위험 수준 내에서 유망하지만 아직 검증되지 않은 설계들을 탐색할 수 있었고, 이는 제한된 환경에서 무작위 추측이나 심지어 더 복잡한 계획 알고리즘보다 뛰어난 성과를 냈습니다.

또한 연구는 설계를 한꺼번에 만드는 것이 아니라 층(layer)을 쌓아 올리는 방식으로 구축할 때 이 필터들이 어떻게 작동하는지도 조사했습니다. 그들은 하나의 전역적인(global) 필터링 규칙이 구축의 각 단계에서 발생하는 특수한 어려움을 반영하지 못하는 경우가 많다는 것을 발견했습니다. 예를 들어, 네트워크의 초기 얕은 부분에 잘 작동하는 규칙이 깊고 복잡한 부분에서는 너무 느슨하거나 너무 엄격할 수 있습니다. 이 적응형 방식을 설계 구축의 각 단계별로 별도로 적용함으로써, 네트워크가 아무리 깊어지더라도 각 단계에서 안전 보장이 유지되도록 할 수 있었습니다. 이러한 세밀한 제어는 일률적인 접근 방식으로는 감지할 수 없었을 체계적인 오류를 방지했습니다.

궁극적으로, 이 연구는 제한된 장치를 위한 인공지능을 설계하는 고도의 전략이 필요한 게임에서 가장 중요한 도구는 반드시 더 똑똑한 예측기가 아니라, 더 정직한 예측기라는 점을 보여줍니다. 기존의 방식들은 데이터가 어떻게 행동할지에 대한 가정에 의존했으나, 그 가정은 학습 행위 자체에 의해 깨졌습니다. 새로운 방식은 그러한 가정을 버립니다. 대신, 현실에 대한 지속적이고 분포에 의존하지 않는(distribution-free) 검증에 의존하며, 매 순간 자신의 신뢰도를 조정합니다. 이는 탐색 과정이 효율적이면서도 안전하며, 자신이 어떤 위험을 감수하고 있는지 정확히 알고, 단지 다이얼을 돌리는 것만으로도 더 많이 혹은 더 적게 위험을 감수하도록 조정할 수 있음을 입증합니다. 정적인 규칙에서 동적이고 자기 수정적인 제어로의 이러한 전환은, 차세대 자원 제한형 기기를 구축하기 위한 견고한 길을 제시합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →