← 최신 논문
🤖 AI

A Neuro-Symbolic Approach for Probabilistic Reasoning on Graph Data

본 논문은 GNN의 학습 강점과 RBN의 확률적 추론 능력을 결합하기 위해 그래프 신경망(GNN)을 관계형 베이지안 네트워크(RBN)에 통합하는 뉴로-심볼릭 프레임워크를 제시하며, 새로운 MAP 추론 방법과 벤치마크 데이터셋을 통해 집단 분류 및 환경 계획 측면에서 향상된 성능을 입증한다.

원저자: Raffaele Pojer, Andrea Passerini, Kim G. Larsen, Manfred Jaeger

게시일 2026-07-20
📖 5 분 읽기🧠 심층 분석

원저자: Raffaele Pojer, Andrea Passerini, Kim G. Larsen, Manfred Jaeger

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 컴퓨터에게 세상을 이해하는 법을 가르치려 한다고 상상해 보십시오. 오랫동안 과학자들은 이 작업을 위해 두 가지 매우 다른 도구 상자를 가지고 있었습니다. 첫 번째는 "신경망(Neural Network)"으로, 이는 마치 매우 관찰력이 뛰어난 화가와 같습니다. 수백만 개의 사진이나 패턴을 보고 시행착오를 거치며 학습하여, 다음에 무엇이 올지 추측하는 데 놀라울 정도로 능숙해집니다. 하지만 이는 일종의 '블랙박스'입니다. 왜 그런 추측을 했는지 그 이유를 실제로 알지 못하며, "A가 발생하면 B가 반드시 일어나야 한다"와 같은 엄격한 규칙을 쉽게 따를 수 없습니다. 두 번째 도구 상이는 "기호 논리(Symbolic Logic)"로, 이는 엄격한 사서나 변호사와 같습니다. 규칙을 완벽하게 따르고 복잡한 논증을 풀어낼 수 있지만, 스스로는 지저치고 복잡한 현실 세계의 데이터로부터 학습하는 데 어려움을 겪습니다.

현대 과학의 큰 질문은 이것입니다. 우리는 어떻게 하면 관찰력 있는 화가와 엄격한 변호사 둘 다의 면모를 갖춘 로봇을 만들 수 있을까요? 우리는 시스템이 데이터를 통해 학습하는 동시에 세상의 규칙도 함께 이해하기를 원합니다. 이것이 바로 "뉴로-심볼릭(Neuro-Symbolic)" AI라는 꿈의 목표입니다. 문제는 이 두 도구가 서로 다른 언어를 사용한다는 점입니다. 하나는 숫자와 가중치(weights)의 언어로 말하고, 다른 하나는 논리와 기호의 언어로 말합니다. 이 논문은 우리가 어떻게 마침내 그들이 서로 대화하게 할 수 있는지, 특히 소셜 네트워크나 도로 지도처럼 거대한 연결망의 형태를 띤 데이터를 다룰 때를 중심으로 그 간극을 메우고자 합니다.


위대한 번역가: 수학과 논리가 악수하도록 가르치기

이 논문은 두 가지 강력한 AI 유형인 **그래프 신경망(GNN)**과 관계적 베이지안 네트워크(RBN) 사이의 보편적 번역기 역할을 하는 영리한 새로운 프레임워크를 소개합니다. GNN을 사람들의 무리(그래프)를 보고 친구 관계나 외양을 바탕으로 누가 어느 그룹에 속하는지 추측하는 데 탁월한 형사라고 생각해 보십시오. 하지만 이 형사는 고립되어 작동합니다. 각 개인을 독립적으로 추측할 뿐, 전체 집단이 조화를 이루는지에는 크게 신경 쓰지 않습니다. 반면, RBN은 관계의 전체 웹을 이해하고 확률에 대해 추론할 수 있는 숙련된 전략가와 같지만, 보통 인간이 모든 규칙을 직접 작성해 주어야 합니다.

저자들(알보르그 대학교와 트렌토 대학교 연구진)은 이 둘 사이의 다리를 놓았습니다. 그들은 GNN이 추측을 하기 위해 사용하는 수학이 사실 RBN이 확률을 계산할 때 사용하는 수학과 동일하다는 것을 보여주었습니다. 이는 마치 화가가 그림을 그릴 때 사용하는 비밀 코드가 사실 변호사가 계약서를 쓸 때 사용하는 언어와 같다는 것을 발견한 것과 같습니다. 이 덕분에, 이제 우리는 "화가"(GNN)를 "변호사"(RBN)의 뇌 속에 직접 꽂아 넣을 수 있게 되었습니다.

그들은 두 가지 방식으로 이 다리를 구축했습니다. 첫 번째 방법은 화가의 그림 전체를 법률 문서로 단어 하나하나 정밀하게 번역하는 것과 같습니다. 이는 매우 긴밀하고 정밀하지만 계산 속도가 느려질 수 있습니다. 두 번째 방법은 변호사에게 화가에게 연결되는 직통 전화선을 주는 것과 같습니다. 변호사가 화가에게 추측을 요청하면, 화가는 자신만의 빠른 소프트웨어를 실행하여 답을 내놓습니다. 두 방법 모두 작동하며, 두 방법 모두 시스템이 화가의 속도와 변호사의 추론 능력을 동시에 사용할 수 있게 해줍니다.

"집단 사고" 문제 해결하기

이 새로운 시스템이 작동함을 증명하기 위해, 연구진은 두 가지 매우 다른 문제를 시도했습니다.

첫 번째 문제는 **집단 분류(collective classification)**에 관한 것이었습니다. 당신이 마을 사람들의 정치적 정당을 맞히려고 한다고 가정해 봅시다. 표준적인 GNN은 한 사람을 보고, 그가 스포츠를 좋아한다는 것을 확인한 뒤 "정당 A"라고 추측할 것입니다. 그는 모든 사람에 대해 독립적으로 이 작업을 수행합니다. 하지만 현실 세계에서 사람들은 종종 이웃과 비슷하게 행동합니다. 만약 당신의 절친한 친구가 "정당 B"라면, 당신도 "정당 B"일 가능성이 높습니다. 저자들은 새로운 시스템을 사용하여 GNN이 전체적인 그림을 보도록 강제할 수 있음을 보여주었습니다. 그들은 "이봐, 만약 네 이웃 대부분이 정당 B라면, 너의 추측도 아마 그쪽으로 기울어야 해"라는 "규칙"을 추가했습니다.

그들은 합성 데이터(특정 패턴을 보이도록 설계된 가상의 그래프)와 실제 소셜 네트워크 데이터를 통해 이를 테스트했습니다. 결과는 인상적이었습니다. 데이터가 지저치거나 이웃들의 신호가 상충할 때, 표준 G한 GNN은 혼란에 빠졌습니다. 하지만 MAP 추론(전체 집단에 대해 가장 가능성 높은 단 하나의 시나리오를 찾는 세련된 방식)을 사용하는 새로운 "뉴로-심볼릭" 버전은 이러한 실수들을 바로잡았습니다. 어떤 경우에는 정확도를 거의 30%까지 높였습니다. 이는 독립적인 추측가들의 모임을 집단의 역학을 이해하는 스마트한 팀으로 탈바꿈시켰습니다.

환경 계획가: 이윤과 오염 사이의 균형 잡기

두 번째이자 아마도 더 흥-미로운 응용 분야는 다목적 의사결정(multi-objective decision-making) 과제였습니다. 당신이 농부들이 어떤 작물을 재배해야 할지 결정하는 도시 계획가라고 상상해 보십시오. 당신에게는 서로 충돌하는 두 가지 목표가 있습니다. 하나는 돈을 버는 것(이윤)이고, 다른 하나는 강을 깨끗하게 유지하는 것(낮은 오염)입니다.

보통 AI는 단지 무엇이 일어날 것인지를 예측할 뿐입니다. 하지만 이 시스템에는 "최선의 균형을 얻으려면 우리는 무엇을 해야 하는가?"라고 물을 수 있습니다. 저자들은 아이오와주의 실제 유역(watershed)을 설정한 시나리오를 구성했습니다. 그들은 GNN을 사용하여 서로 다른 작물이 수질 오염에 어떤 영향을 미칠지 예측했습니다. 그런 다음, 새로운 프레임워크를 사용하여 "만약(what-if)" 시뮬레이션을 실행했습니다. 그들은 시스템에 다음과 같이 물었습니다. "만약 우리가 이윤에 70%, 깨끗한 물에 30%의 비중을 두고 싶다면, 이 지역의 모든 농장에 대해 옥수수, 콩, 목초의 완벽한 조합은 무엇인가?"

시스템은 단순히 추측하는 데 그치지 않고, 가장 확률 높은 최적의 솔루션을 계산해 냈습니다. 시스템은 어떤 지역에서는 옥수수(수익은 높지만 오염을 유발함)를 재배하는 것이 괜찮지만, 물 근처에 있는 다른 지역에서는 목초(수익은 낮지만 더 깨끗함)로 전환하는 것이 강을 안전하게 지키는 유일한 방법이라는 것을 찾아냈습니다. 그들은 심지어 "부분적" 작물(예: 한 농지에 옥수수 30%와 콩 70%)을 허용하도록 규칙을 완화하면, 시스템이 훨씬 더 나은 솔루션을 더 빠르게 찾을 수 있다는 점도 보여주었습니다. 이는 이 시스템이 단순한 예측기를 넘어, 복잡한 현실 세계의 계획을 위한 의사결정 지원 도구로 기능할 수 있음을 입증합니다.

결점: 속도냐, 똑똑함이냐

이 논문은 트레이드오프(trade-off)에 대해서도 솔직하게 밝히고 있습니다. 이 새로운 시스템은 믿을 수 없을 정도로 유연하고 똑똑하지만, 표준 AI보다 느릴 수 있습니다. 테스트 결과, 실제 데이터셋에서 추론(생각하는 부분)을 실행하는 데 약 70분이 걸린 반면, 경쟁 시스템은 단 45초밖에 걸리지 않았습니다. 왜 그럴까요? 새로운 시스템은 훨씬 더 무거운 일을 하고 있기 때문입니다. 단순히 추측하는 것이 아니라, 모든 규칙에 부합하는 절대적인 최선의 시나리오를 찾기 위해 수백만 개의 가능한 시나리오를 탐색하고 있는 것입니다.

저자들은 이 시스템이 가장 빠른 도구는 아닐지라도, 가장 다재다능한 도구라고 제안합니다. 이 시스템은 다른 AI들이 손댈 수 없는 문제들, 즉 상충하는 목표 사이의 균형을 맞추거나 복잡한 집단 행동을 이해하는 문제들을 다룰 수 있습니다. 그들은 이 프레임워크가 데이터로부터 학습하면서 동시에 세상의 논리적 규칙을 존중할 수 있는 새로운 종류의 AI로 가는 문을 열어주며, 소셜 네트워크를 수정하는 것부터 지속 가능한 도시를 계획하는 것까지 모든 분야에 강력한 도구가 될 수 있다고 결론지었습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →