Probabilistic Circuits as Reasoning Machines in Artificial Intelligence (Part I)
이 누적 학위 논문의 첫 번째 부분은 확률적 회로(probabilistic circuits)를 불확실성 하에서의 AI 추론 및 학습을 위한 다루기 쉬운 프레임워크로서 옹호하며, 이들의 기초 이론, 학습 알고리즘, 확장 가능한 구현, 그리고 딥러닝 및 심볼릭 머신러닝 패러다임과의 통합에 관한 지난 10년간의 연구를 종합한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
생각하는 기계를 만들기 위한 탐구 과정에서, 과학자들은 지능을 위한 최적의 언어가 무엇인지에 대해 오랫동안 논쟁해 왔습니다. 한 진영은 사실이 절대적이며 결론이 엄격한 규칙을 따르는 경직된 논리를 주장합니다. 다른 진영은 인간의 뇌와 유사하게 방대한 양의 데이터에서 패턴을 발견하며 학습하는 신경망을 선호합니다. 그러나 불확실성을 해결해야 할 결함이 아니라 세상의 근본적인 특징으로 취급하는 세 번째의, 더 오래된 경로가 존재합니다. 이 접근 방식은 확률이라는 수학적 프레임워크에 의존하며, 이는 시스템이 "확신할 수는 없지만, 서로 다른 결과들이 발생할 가능성은 이렇다"라고 말할 수 있게 해줍니다. 이것은 위험을 다루는 언어이자, 날씨를 예측하거나 의사가 증상을 진단과 대조하여 무게를 다는 것과 같은 언어입니다. 확률의 힘은 알려진 것과 알려지지 않은 것을 결합하고, 새로운 증거가 도착함에 따라 신념을 업데이트하는 능력에 있습니다. 하지만 수십 년 동안, 이 우아한 언어는 실제로 사용하기가 매우 어려웠습니다. 확률로 추론하는 규칙 자체는 단순하지만, 복잡한 현실 세계의 문제를 위해 계산을 수행하는 것은 종종 컴퓨터가 우주의 나이보다 더 긴 시간 동안 수행해야 하는 불가능한 수의 단계를 요구하기 때문입니다.
그라츠 공과대학교의 연구원인 로버트 페하르츠(Robert Peharz)는 지난 10년 동안 이 계산상의 병목 현상을 해결하기 위해 노력해 왔습니다. 그의 연구는 '확률 회로(probabilistic circuit)'라고 불리는 특정 유형의 모델에 집중합니다. 거대한 가지치기 나무를 상상해 보십시오. 모든 잎은 단순한 정보 조각을 나타내고, 모든 가지는 이 조각들을 결 조합하여 세상의 완전한 그림을 형성합니다. 표준 모델에서는 특정 시나리오의 가능성을 계산하기 위해 이 나무의 가능한 모든 경로를 추적해야 하는데, 이는 나무가 성장함에 따라 기하급수적으로 어려워지는 작업입니다. 페하르츠의 연구는 이 가지들이 연결되는 방식에 몇 가지 엄격한 구조적 규칙을 부과함으로써, 전체 계산을 빠르고 정확하게 만들 수 있음을 보여줍니다. 이러한 규칙은 모델이 모든 가능성을 세려고 시도하다가 갇히지 않도록 보장합니다. 대신, 모델은 일련의 증상에 대해 가장 가능성 높은 원인을 예측하거나, 산더미 같은 데이터를 바탕으로 특정 사건이 발생할 확률을 결정하는 것과 같은 복잡한 질문에 즉각적으로 답할 수 있습니다.
페하르츠의 기여의 핵심은 이러한 회로가 단순히 새로운 발명품이 아니라, 많은 기존 방법론을 아우르는 통합적인 언어라는 깨달음입니다. 그는 산술 회로(arithmetic circuits)부터 합-곱 네트워크(sum-product networks)에 이르기까지 다양한 모델이 실제로는 동일한 근저 구조를 가진 서로 다른 이름일 뿐임을 보여줍니다. 이들을 하나의 응집된 가족으로 다룸으로써, 그는 전반적으로 작동하는 일련의 표준 도구들을 개발할 수 있었습니다. 그의 주요 발견 중 하나는 이러한 회로가 '매끄럽고(smooth)' '분해 가능하도록(decomposable)' 구축될 수 있다는 것입니다. 쉽게 말해, 이 모델은 알 수 없는 동일한 요인에 의존하는 두 정보 조각을 곱하려고 시도하지 않으며, 서로 다른 사실들을 포괄하는 두 가지 다른 가능성을 더하지 않도록 조직되어 있습니다. 이러한 구조적 제약은 컴퓨터 계산을 위한 교통 체계처럼 작용하여, 교통 정체를 방지하고 정보가 나무의 바닥에서 꼭대기까지 원활하게 흐르도록 보장합니다.
이러한 조직화 덕분에 컴퓨터는 이전에는 너무 어렵다고 여겨졌던 과업들을 수행할 수 있습니다. 예를 들어, 상황의 평균적인 결과를 계산하거나 관찰된 결과들에 대한 단 하나의 가장 확률 높은 설명을 순식간에 찾아낼 수 있습니다. 페하르츠는 또한 이러한 회로가 데이터로부터 학습하도록 가르치는 방법도 개발했습니다. 그는 모델이 추측할 필요 없이 데이터를 가장 잘 맞출 수 있도록 내부 가중치를 자동으로 조정하는 방법들을 개발했습니다. 나아가, 그는 이러한 회로가 강력하지만 계산량이 많은 다른 머신러러닝 도구들과 결합될 수 있음을 증명했습니다. 확률 회로를 사용하여 문제의 쉬운 부분을 처리하는 빠르고 신뢰할 수 있는 엔진으로 활용하고, 더 느리고 복잡한 모델이 어려운 부분을 처리하게 함으로써, 시스템 전체는 강력하면서도 효율적이 됩니다. 이러한 하이브리드 접근 방식은 연구자들이 정확할 뿐만 아니라 자신의 추론 과정을 설명할 수 있는 모델을 구축할 수 있게 해줍니다.
이 연구는 통계적 학습과 기호 논리 사이의 간극을 메웁니다. 페하르츠는 이러한 회로가 규칙에 기반하여 선택을 내리는 고전적인 방법인 결정 트리(decision trees)로 변환될 수 있음을 입증했습니다. 이러한 연결은 시스템이 누락된 데이터를 우아하게 처리할 수 있게 합니다. 만약 정보의 일부가 누락된다면, 회로는 단순히 그 가지를 무시하고 여전히 유효한 답을 제공할 수 있으며, 실패하지 않습니다. 그는 또한 이 아이디어를 사이버 보안 분야에 적용하여, 전력 소비와 같은 물리적 측면 채널(side-channels)을 분석하여 비밀 암호 키를 찾아내는 데 사용했습니다. 이러한 테스트에서 회로 기반 접근 방식은 이전 방법들보다 노이즈에 훨씬 더 성공적이고 견고했습니다.
연구 전반에 걸쳐 페하르츠는 이 분야의 흔한 오해, 즉 계산하기 쉬운 모델과 복잡한 현실을 묘사할 만큼 표현력이 풍부한 모델 중 하나를 선택해야 한다는 생각에 대응해 왔습니다. 그의 결과는 이것이 잘못된 선택임을 보여줍니다. 확률 회로가 특정 유형의 데이터를 얼마나 압축적으로 표현할 수 있는지에 대한 한계는 존재하지만, 그는 많은 실질적인 응용 분야에서 이러한 모델이 계산이 불가능한 더 복잡한 대안들만큼이나 좋거나 혹은 오히려 더 낫다는 것을 보여주었습니다. 그는 또한 비정규화된 가중치(unnormalized weights)와 같은 특정 기능을 추가하는 것이 실제로 모델의 능력을 높이지 않는다는 점을 명확히 했으며, 이는 시스템 설계의 단순화에 도움을 주는 발견입니다.
이 연구의 궁극적인 목표는 똑똑할 뿐만 아니라 신뢰할 수 있고 이해 가능한 인공지능을 만드는 것입니다. 확률의 엄격한 규칙에 AI를 접목하고 계산을 정확하고 빠르게 수행할 수 있도록 보장함으로써, 페하르츠의 연구는 인간 전문가가 가질 수 있는 것과 같은 확신을 가지고 불확실성 아래에서 추론할 수 있는 기계의 토대를 제공합니다. 이 접근 방식은 현대 AI 시스템의 '블랙박스' 특성을 넘어, 결론이 어떻게 도출되었는지 정확히 볼 수 있는 방법을 제시합니다. 이러한 방법들이 딥러닝 프레임워크에 통합되고 다른 기술들과 결합됨에 따라, 이들은 속도나 정확도를 희생하지 않으면서도 세상의 무질서하고 불확실한 현실을 다룰 수 있는, 더욱 신뢰할 수 있는 인공지능을 약속합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.