The RAIL Principles for Neurosymbolic AI: Reasoning, Assurances, Interfacing and Learning
이 논문은 다양한 응용 분야에 걸쳐 머신러닝과 형식적 추론을 통합하는 신뢰할 수 있는 신뢰성 있는 뉴로심볼릭 AI 시스템을 분석하고 설계하기 위한 통합된 관점으로서 RAIL(Reasoning, Assurances, Interfacing, and Learning) 프레임워크를 소개한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 로봇에게 세상을 항해하는 법을 가르치려 한다고 상상해 보십시오. 당신에게는 매우 다른 두 명의 스승이 있습니다. 첫 번째는 '슈퍼 관찰자(Super-Observer)'입니다. 이 기계는 수백만 시간의 영상을 시청하며 패턴을 찾아내고 다음에 일어날 일을 추측하며 학습합니다. 이 스승은 매우 빠르고 얼굴을 인식하거나 시를 쓰는 데 능숙하지만, 종종 사실을 지어내기도 하고, 어제 배운 것을 잊어버리기도 하며, 왜 빨간불이 '정지'를 의미하는지 설명하지 못합니다. 두 번째는 '엄격한 사서(Strict Librarian)'입니다. 이 기계는 경직된 규칙 책을 따릅니다. 인간이 논리 책에 적어둔 대로 빨간불이 무엇을 의미하는지 정확히 알고 있으며, 결코 그 규칙을 어기지 않습니다. 하지만 사서는 느리고, 인간이 모든 규칙을 직접 작성해 주어야 하며, 규칙 책에 언급되지 않은 것을 보면 완전히 혼란에 빠집니다.
오랫동안 과학자들은 이 두 스승이 서로 다른 방에서 작업해야 한다고 생각했습니다. 하지만 최근 한 가지 새로운 아이디어가 등장했습니다. 만약 이들을 함께 일하게 한다면 어떨까 하는 것입니다. **뉴로심볼릭 AI(Neurosymbolic AI)**라고 불리는 이 분야는 '슈퍼 관찰자'의 패턴 포착 능력과 '엄격한 사서'의 규칙 준수 능력을 결합하려 합니다. 목표는 단순히 똑똑하고 유연할 뿐만 아니라, 자율주행 자동차나 의료 진단와 같이 이해관계가 걸린 중요한 상황에서도 안전하고 설명 가능하며 신뢰할 수 있는 시스템을 구축하는 것입니다. 큰 질문은 이것입니다. 어떻게 하면 이 두 지능이 서로 싸우지 않게 하면서 이러한 하이브리드 두뇌를 실제로 구축할 수 있을까요?
전 세계 대학과 연구소의 연구진이 발표한 한 새로운 논문은 그 로드맵을 제시합니다. 저자들은 우리가 완전히 새로운 유형의 AI를 발명할 필요는 없다고 주장합니다. 대신, 체스에서 인간을 이기거나 단백질 구조를 접는 것과 같은 가장 진보된 시스템 중 상당수는 이미 특정 설계 규칙을 비밀리에 따르고 있다는 것입니다. 저자들은 이 규칙을 RAIL이라 부르며, 이는 **추론(Reasoning), 보증(Assurances), 인터페이싱(Interfacing), 학습(Learning)**의 약자입니다. 저자들은 이 네 가지 관점을 통해 AI 시스템을 바라봄으로써, 우리가 어떻게 작동하는지 이해하고, 약점을 찾으며, 더 나은 미래형 시스템을 설계할 수 있다고 제안합니다.
RAIL 로드맵의 네 가지 기둥
이 논문은 모든 뉴로심볼릭 시스템이 네 가지 원칙에 따른 슬라이딩 스케일(조절 눈금) 상의 어디에 위치하는지로 설명될 수 있다고 제안합니다. 이 원칙들을 켜거나 끄는 '스위치'가 아니라, 시스템의 균형을 맞추기 위해 돌릴 수 있는 '다이얼'이라고 생각하십시오.
1. 추론(Reasoning): "어떻게 생각하는가?" 다이얼
이 다이얼은 시스템이 어떻게 점들을 연결하는지를 측정합니다. 한쪽 끝에는 시스템이 이전에 본 패턴을 바탕으로 답을 추측하는 **암묵적 추론(Implicit Reasoning)**이 있습니다. 이는 마치 수학 원리는 이해하지 못한 채 정답지만 암기하는 학생과 같습니다. 다른 쪽 끝은 시스템이 탐정이 단서를 적어가며 사건을 해결하듯 단계별 논리 체인을 따르는 **명시적 추론(Explicit Reasoning)**입니다.
논문은 구글의 알파(Alpha) 제품군(게임이나 수학 증명을 해결하는 모델)처럼 가장 강력한 시스템들이 그 중간 어디쯤에 위치한다고 지적합니다. 이들은 신경망을 사용하여 빠른 추측(암묵적)을 수행하지만, 그 추측이 타당한지 확인하기 위해 엄격한 논리(명시적)를 사용합니다. 저자들은 '추측' 측면에만 의존하면 오류와 '환각(hallucination, 사실을 지어내는 현상)'이 발생하므로, 진정으로 신뢰할 수 있는 시스템이 되기 위해서는 다이얼의 전체 범위를 사용해야 한다고 제안합니다.
2. 보증(Assurances): "신뢰할 수 있는가?" 다이얼
이것은 안전 보증에 관한 것입니다. 한쪽에는 시스템을 먼저 훈련시킨 다음 나중에 테스트하여 안전한지 확인하는 사후 검증(Verified Ex-Post) 방식이 있습니다. 이는 위험한 버그를 너무 늦게 발견할 수 있기 때문에 위험합니다. 다른 쪽에는 안전 규칙이 처음부터 시스템의 두뇌 속에 내재되어 있는 설계에 의한 검증(Verified by Design) 방식이 있습니다.
논문은 중요한 업무를 수행하기 위해서는 '설계에 의한 검증'으로 이동해야 한다고 주장합니다. 예를 들어, 수학 증명을 푸는 시스템이라면 단순히 '아마 틀리지 않을 것'이 아니라, '틀린 증명을 생성할 수 없도록' 구축되어야 합니다. 저자들은 복잡한 신경망에 대해 이를 수행하는 것이 어렵지만, 이를 심볼릭 규칙과 결합하면 시스템이 충돌하거나 안전하지 않은 행동을 하지 않을 것이라는 보장을 할 수 있다고 언급합니다.
3. 인터페이싱(Interfacing): "대화할 수 있는가?" 다이얼
이 원칙은 인간이 AI와 얼마나 쉽게 대화할 수 있는지, 그리고 AI가 자신을 얼마나 잘 설명할 수 있는지를 묻습니다. 한쪽 끝에는 인간이 읽을 수 없는 숫자의 비밀 코드로 사고하는 **순수 임베딩(Pure Embeddings)**이 있습니다. 다른 쪽 끝에는 모든 것이 인간이 검사할 수 있는 명확한 논리 언어나 코드로 작성된 **순수 심볼릭 표현(Pure Symbolic Representations)**이 있습니다.
논문은 많은 강력한 AI 시스템이 '블랙박스'라는 문제를 강조합니다. 우리는 그들이 왜 그런 결정을 내렸는지 알기 위해 내부를 들여다볼 수 없습니다. RAIL 프레임워크는 '혼합 표현(Mixed Representations)'이 필요하다고 제안합니다. 즉, 시스템이 자신의 숫자 계산 과정을 그래프나 논리적 설명처럼 인간이 이해할 수 있는 형태로 번역할 수 있어야 한다는 것입니다. 이는 의사가 컴퓨터의 치료 권고 이유를 알아야 하는 의료 AI와 같은 분야에서 매우 중요합니다.
4. 학습(Learning): "어떻게 가르치는가?" 다이얼
마지막으로, 이 다이얼은 시스템이 어떻게 학습하는지를 살펴봅니다. 한 극단에는 AI를 데이터의 홍수에 던져 넣어 스스로 모든 것을 깨닫게 하는 **데이터 전용 학습(Data-Only Learning)**이 있습니다. 다른 극단에는 인간이 모든 규칙을 작성하는 **학습 없음(No Learning)**이 있습니다.
논문이 제안하는 최적의 지점은 **지식 가이드 학습(Knowledge-Guided Learning)**입니다. 이는 AI에게 기초적인 규칙이나 사실(예: 물리 AI에게 에너지는 생성되거나 소멸되지 않는다는 법칙을 알려주는 것)을 먼저 제공한 뒤, 나머지는 데이터로부터 배우게 하는 방식입니다. 이렇게 하면 AI가 더 빠르게 학습하고, 더 적은 데이터가 필요하며, 어처구니없는 실수를 덜 하게 됩니다. 일부 고급 시스템은 데이터로부터 배우면서도 학습한 내용을 바탕으로 자신의 규칙을 업데이트하는 **양방향 학습(Bidirectional Learning)**을 사용하여 개선의 순환 구조를 만듭니다.
이것이 미래에 갖는 의미
저자들은 자신들이 AI의 모든 문제를 해결했다고 주장하는 것이 아닙니다. 대신, RAIL 프레임워크가 엔지니어들이 더 나은 선택을 하도록 돕는 도구라고 제안합니다. 기존 시스템을 이 네 가지 원칙을 통해 살펴본 결과, 많은 '뉴로심볼릭' 시스템이 비록 스스로 그렇게 부르지는 않더라도 이미 훌륭한 일을 수행하고 있음을 발견했습니다. 예를 들어, 도구를 사용하는 시스템(문제를 해결하기 위해 코드를 작성하는 AI 등)이나 물리 법칙을 배우는 시스템은 이미 이러한 원칙들을 사용하여 안전성과 정확성을 유지하고 있습니다.
그러나 논문은 트레이드오프(상충 관계)에 대해서도 경고합니다. 시스템을 '순수 논리' 쪽으로 너무 밀어붙이면 현실의 복잡함을 처리하기에 너무 경직될 수 있습니다. 반대로 '순수 학습' 쪽으로 너무 밀어붙이면 예측 불가능하고 안전하지 않을 수 있습니다. 목표는 특정 작업에 맞는 적절한 균형을 찾는 것입니다.
요약하자면, 이 논문은 AI 커뮤니티를 향한 행동 촉구입니다. 신뢰할 수 있는 AI의 미래는 '똑똑한 추측'과 '엄격한 규칙' 중 하나를 선택하는 것이 아니라, 두 가지를 모두 사용할 줄 아는 시스템을 구축하는 데 있다는 것을 시사합니다. RAIL 원칙을 사용함으로써, 엔지니어들은 강력할 뿐만 아니라 안전하고, 설명 가능하며, 인류의 가장 어려운 문제들을 해결할 준비가 된 AI를 설계할 수 있습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.