NeSyCat Torch: A Differentiable Tensor Implementation of Categorical Semantics for Neurosymbolic Learning
NeSyCat Torch는 레이지 로그-텐서 모나드(lazy log-tensor monad)를 통한 미분 가능한 텐서 기반 학습을 구현함으로써 다양한 신경 기호적 의미론을 단일 모나딕 프레임워크 아래 통합하며, 이를 통해 기존 시스템 대비 MNIST 덧셈 작업에서 우수한 속도와 정확도를 달행하는 동시에 다양한 1차 논리 접근 방식에 적응 가능한 균일한 구조를 유지한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
큰 문제: 너무 많은 언어들
로봇에게 생각하는 법을 가르치려는 전문가 팀이 있다고 상상해 보세요.
- 고전적 전문가는 엄격한 "예/아니오" 논리로 말합니다.
- 퍼지(Fuzzy) 전문가는 "아마도" 또는 "어느 정도"라고 말합니다.
- 확률적 전문가는 백분율과 확률로 말합니다.
- 신경망 전문가(AI)는 사진을 보고 패턴을 추측하며 학습합니다.
문제는 이 전문가들이 모두 서로 다른 언어를 사용한다는 점입니다. 그들은 무엇이 "참"인지에 대해 서로 다른 규칙을 가지고 있습니다. 고전적 전문가가 규칙을 쓰면, 확률적 전문가는 그것을 이해할 수 없고, 신경망 전문가는 그것으로부터 배울 수 없습니다. 이것을 **파편화(fragmentation)**라고 부릅니다.
해결책: 만능 번역기 (NeSyCat)
저자들은 이전에 NeSyCat이라는 "만능 번역기"를 만들었습니다. 이것은 그 모든 전문가의 언어를 하나의 통일된 규칙집으로 번로할 수 있는 마스터 설계도라고 생각하면 됩니다. 이 시스템은 논리를 담기 위해 **모나드(Monad)**라는 수학적 도구(이를 "컨테이너" 또는 "래퍼"라고 생각할 수 있음)를 사용합니다.
하지만 지금까지 이 번역기에는 빠진 조각이 하나 있었습니다. 규칙을 설명할 수는 있었지만, 실제로 신경망 전문가(AI)에게 그 규칙을 배우는 법을 가르칠 수는 없었다는 점입니다. 이는 자동차의 설계도는 있지만 엔진은 없는 것과 같았습니다.
등장: NeSyCat Torch — 엔진
NeSyCat Torch는 바로 그 빠져있던 엔진입니다. 이 시스템은 그 만능 설계도를 가져와 현대적인 AI 도구(PyTorch 및 JAX와 같은)에 직접 연결합니다. 이를 통해 AI는 단순히 추측하는 것이 아니라, 규칙으로부터 학습할 수 있게 됩니다.
작동 방식은 세 가지 간단한 계층으로 나뉩니다.
1. "게으른" 회계사 (학습 모나드)
AI가 학습할 때는 많은 수학 계산을 수행합니다. 만약 모든 가능성을 한꺼번에 계산하려고 하면, 숫자가 너무 복잡해져서 컴퓨터가 다운되거나 시간이 너무 오래 걸립니다.
- 비유: 국물 맛을 보는 요리사를 상상해 보세요. 만약 요리사가 소금 알갱이 하나하나의 맛을 다 봐야 한다면, 결코 요리를 끝낼 수 없을 것입니다. 대신, 그들은 냄비 전체의 맛을 한 번에 봅니다.
- 논문의 비법: 저자들은 "게으른(Lazy)" 접근 방식을 사용합니다. 모든 결과의 확률을 즉시 계산하지 않습니다. 대신 계산을 아주 마지막 단계까지 미룹니다. 그들은 숫자를 안정적이고 다루기 쉽게 유지하기 위해 특수한 "로그-텐서(Log-Tensor)" 컨테이너를 사용하여, 마치 실제로 요리를 할 때만 업데이트되는 레시피 노트처럼 관리합니다.
2. "배치" 컨베이어 벨트 (배치 모나드)
보통 AI는 사진 한 장을 보고, 추측을 하고, 그다음 사진을 보는 방식으로 학습합니다. 이는 매우 느립니다.
- 비유: 공장 라인을 상상해 보세요. 자동차 한 대씩 검사하는 대신, 32대의 자동차를 컨베이어 벨트에 올려놓고 동시에 검사하는 것과 같습니다.
- 논문의 비법: 그들은 데이터의 한 묶음(미니 배치)을 하나로 묶어 처리하는 "배치 모나드"를 사용합니다. AI는 이 그룹 전체를 한 번에 처리하며, 이는 학습 속도를 믿을 수 없을 정도로 빠르게 만듭니다.
3. "양방향" 다리
시스템은 흐릿한 이미지를 보는 신경망과 명확한 답을 원하는 논리 규칙 사이에서 대화를 나누어야 합니다.
- 비유: "흐릿한 이미지"와 "명확한 논리"를 모두 구사하는 번역가를 생각해 보세요.
- 논문의 비법: 그들은 다리를 건설했습니다. AI가 "7"이라는 흐릿한 이미지를 볼 때, 단순히 "7"이라고 추측하는 데 그치지 않고 "가능성의 구름(확률 분포)"을 생성합니다. 그런 다음 시스템은 이 구름들을 결합하는(마치 물감을 섞는 것처럼) 수학적 방법을 사용하여, 최종 결과가 규칙(예: "이 이미지와 저 이미지를 더하면 15가 되는가?")과 일치하는지 확인합니다.
테스트: 손글씨 숫자 추가하기
성능을 증명하기 위해, 저자들은 고전적인 과제인 MNIST Addition으로 시스템을 테스트했습니다.
- 과제: AI에게 두 개의 손글씨 숫자(예: 3과 4)를 보여주되, 숫자 자체는 숨깁니다. AI는 오직 그 합계(7)만을 봅니다.
- 목표: AI는 합계를 통해 개별 숫자를 인식하는 법을 배워야 합니다.
- 결과: AI는 약 97%의 정확도로 숫자를 인식하는 법을 배웠습니다.
왜 중요한가 (결과)
저자들은 NeSyCat Torch를 다른 유명한 AI 논리 시스템(LTN 및 DeepProbLog 등)과 비교했습니다.
- 속도: 훨씬 빨랐습니다. 다른 시스템들이 시간이 초과되거나 어려운 문제에서 멈춰버린 반면, NeSyCat Torch는 매끄럽게 계속 실행되었습니다.
- 정확도: LTN과 DeepProbLog보다 더 정확했으며, 가장 뛰어난 시스템인 DeepStochLog에 거의 근접했습니다.
- 유연성: 가장 좋은 점은 이 "만능 번역기"(모나드)를 기반으로 구축되었기 때문에, AI가 생각하는 방식을 바꾸기 위해 "컨테이너"를 교체할 수 있다는 것입니다. 코드 전체를 다시 작성할 필요 없이, 설정 하나만 바꾸는 것으로 "확률"에서 "퍼지 논리"로 전환할 수 있습니다.
요약
NeSyCat Torch는 엄격한 논리와 유연한 학습을 결합하는 새로운 방식의 AI 구축법입니다. 이 시스템은 계산에 얽매이지 않기 위한 영리한 "게으른" 수학적 기법과, 데이터를 빠르게 처리하기 위한 "배칭(batching)" 기법을 사용합니다. 이 시스템은 덧셈의 규칙을 알려주는 것만으로도 AI가 손글씨 숫자를 인식할 수 있다는 것을 증명했으며, 기존 방식들보다 더 빠르고 정확하게 이를 수행했습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.