← 최신 논문
🤖 AI

NeSyFS: A Neuro-symbolic Fast-Slow Thinking Framework for LLM Agent under Partial Observability

본 논문은 지식 그래프를 믿음 상태(belief state) 표현에 활용하고, 부분 관측 가능성 하에서 LLM 에이전트의 성능을 향상시키기 위해 반응적 행동을 불확실성을 고려한 계획 및 성찰과 통합하는 신경-기호론적 fast-slow 사고 프레임워크인 NeSyFS를 제안한다.

원저자: Duo Xu, Faramarz Fekri

게시일 2026-08-03
📖 3 분 읽기☕ 가벼운 읽기

원저자: Duo Xu, Faramarz Fekri

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 화면이 안개로 뒤덮인 비디오 게임을 하고 있다고 상상해 보세요. 캐릭터 바로 앞의 몇 피트만 볼 수 있지만, 거대하고 복잡한 성 안에 숨겨진 보물 상자를 찾아야 합니다. 전체 지도를 볼 수 없으며, 목표물과 비교했을 때 자신이 정확히 어디에 있는지 알 수 없습니다. 이것이 인공지능의 '부분 관측 가능성(partial observability)'의 세계입니다. 이 컴퓨터 과학의 한 구석에서, 연구자들은 챗봇을 움직이는 초지능 텍스트 생성기인 대규모 언어 모델(LLM)이 자율적인 에이전트로서 행동하도록 가르치고 있습니다. 이 에이전트들은 의사결정을 내리고, 도구를 사용하며, 문제를 해결해야 하지만, 종종 전체적인 그림을 보지 못한 채 이를 수행해야 합니다. 큰 과제는 AI가 세상의 전체 상태를 볼 수 없을 때 혼란을 겪는다는 점입니다. 방금 무엇을 했는지 잊어버리거나, 목표를 놓치거나, 틀린 것으로 판명된 추측에 기반해 계획을 세울 수도 있습니다. 과학자들은 직관적인 본능과 신중하고 느린 사고를 결와하여 인간처럼 이 안개 낀 세상을 항해할 수 있는 에이전트를 구축하고자 합니다.

NeSyFS라고 불리는 새로운 프레임워크가 등장했습니다. 이는 신경-기호적 속도-지연 사고(Neuro-symbolic Fast-Slow thinking)를 의미합니다. 이것을 AI 에이전트를 위해 설계된, 특히 그 안개 낀 비디오 게임 시나리오를 처리하기 위한 새로운 운영 체제라고 생각해보세요. 조지아 공대의 연구자인 듀오 쉬(Duo Xu)와 파라마르즈 페크리(Faramarz Fekri)는 이전의 방식들이 마치 모든 대사의 긴 줄거리를 읽으며 영화 전체를 기억하려고 애쓰는 것과 같다는 점을 깨달았습니다. 그것은 너무 많은 정보이며, 중요한 세부 사항은 소음 속에서 길을 잃게 됩니다. 대신, NeSyFS는 AI에게 '지식 그래프(Knowledge Graph)'라는 '살아있는 기억 노트'를 제공합니다. 이것은 단순한 메모 목록이 아니라, "냉장고가 열려 있다"를 "그 안에 컵이 있다"와 연결하는 거미줄처럼 사실들이 구조적으로 얽힌 웹입니다.

이 프레임워크는 인간의 사고 방식에서 영감을 얻어 AI의 뇌를 두 가지 모드로 나눕니다. '빠른 사고(Fast-Thinking)' 모드는 에이전트의 반사 신경입니다. 에이전트는 자신의 기억 노트를 훑어보고 가장 관련 있는 사실(예: "나는 컵이 필요하고, 방금 냉장고 안에서 하나를 보았다")을 잡아내어 빠르게 움직입니다. 하지만 때때로 안개가 너무 짙어 빠른 추측이 틀릴 때가 있습니다. 그때 '느린 사고(Slow-Thinking)' 모드가 개입합니다. 이것은 에이전트의 의도적인 계획가입니다. 그는 단순히 추측하는 것이 아니라, 체스 선수가 세 수 앞을 내다보는 것처럼 머릿속에서 다양한 미래의 경로를 시뮬레이션합니다. 그는 여러 가능한 미래를 동시에 테스트하기 위해 특별한 수학적 기법(Twisted Sequential Monte Carlo라고 불리는 방법에서 빌려온 것)을 사용하여, 유망해 보이는 경로는 유지하고 막다른 길로 이어지는 경로는 버립니다.

에이전트가 경로를 벗어나지 않도록 하기 위해, 세 번째 부분인 '성찰 모듈(Reflection Module)'이 존재합니다. 에이전트가 빠른 움직임을 보일 때마다, 코치가 사이드라인에 서서 기억 노트를 확인하며 그 움직임이 실제로 목표 달성에 도움이 되는지 체크한다고 상상해 보세요. 만약 코치가 "아니, 그건 말이 안 돼"라고 말한다면, 에이전트는 다시 생각해야 합니다. 만약 에이전트가 계속해서 같은 실수를 반복한다면, 코치는 더 나은 전략을 세우기 위해 '느린 사고' 계획가를 호출합니다. 논문은 이러한 조합—구조화된 기억, 빠른 반사 신경, 신중한 계획, 그리고 비판적인 코치—이 AI가 이전 방식들보다 훨씬 더 뛰어난 성능을 보이도록 돕는다고 제안합니다. 세 가지 서로 다른 게임 환경(가상 집, 온라인 상점, 과학 실험실)에서의 테스트에서, NeSyFS 에이전트는 다른 최상위 방식들을 크게 압도하며, 더 자주 과제를 해결하고 오류를 적게 범했습니다. 연구자들은 긴 히스토리 로그를 읽는 대신 구조화된 기억 노트를 사용함으로써, 에이전트가 목표를 똑바로 유지하고 안개 속을 훨씬 더 효과적으로 항해할 수 있었다는 것을 발견했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →