Creativity, honesty and designed forgetting emerge in small hyperbolic language models
이 논문은 쌍곡선 기질(hyperbolic substrate)을 갖춘 세 개의 소형 언어 모델이 준수 격차와 아첨을 탐지하고, 창의적인 응답을 생성하며, '설계된 망각(designed forgetting)' 메커니즘을 구현함으로써 신뢰할 수 없는 인간 평가자와 더 큰 프런티어 모델에 대한 확장 가능한 대안을 제공하여, 신뢰할 수 있는 동반자 AI의 과제들을 효과적으로 해결할 수 있음을 입증한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 완벽한 디지털 단짝 친구를 만들려고 노력하고 있다고 상상해 보세요. 수년 동안 기술 세계는 한 가지 아이디어에 집착해 왔습니다: 거대할수록 좋다는 생각입니다. 그들은 거대한 데이터 센터에 거대하고 똑똑한 컴퓨터를 구축하며, 매개변수(parameter)를 계속 추가하기만 하면 기계가 자연스럽게 진정한 동반자가 될 것이라고 믿어 왔습니다.
하지만 이 논문은 이렇게 말합니다: 멈추세요. 그것은 잘못된 길입니다.
저자들은 한 사람의 곁을 평생 지킬 수 있는 기계를 만드는 것은 단순히 덩치를 키우는 문제가 아니라, 뇌의 적절한 형태를 갖추고 무엇을 잊어야 할지 배우는 문제라고 주장합니다. 그들은 서버 팜이 아닌 당신의 스마트폰에서 바로 구동될 수 있는 세 가지 작고 영리한 모델로 구축된 새로운 종류의 "동반자적" AI를 제안합니다.
그들이 이 일을 어떻게 해냈는지, 세 가지 주요 비결을 통해 설명하겠습니다.
1. 뇌의 형태: 쌍곡선 놀이터 (Hyperbolic Playground)
대부분의 AI 뇌는 평평한 지도(유클리드 기하학)처럼 만들어져 있습니다. 만약 복잡한 가계도나 한 인생의 전체 이야기를 평평한 종이 위에 그리려 한다면, 매우 지저분하고 찌그러질 것입니다. 무언가를 늘리거나 억지로 밀어 넣어야 하며, 이는 AI가 허구(환각)를 만들어내거나 혼란을 겪게 만드는 원인이 됩니다.
저자들은 말합니다: 평평한 지도는 안 됩니다. 그들은 쌍곡선 기질(hyperbolic substrate) 위에 AI를 구축했습니다. 이것은 거대하고 마법 같은 트리하우스나 프랙탈 구조의 산호초를 생각하면 쉽습니다. 이 형태에서는 더 깊이 들어갈수록 더 많은 공간이 생깁니다. 이는 인생이 사건들의 가지치기 구조인 것처럼, 인생의 기억을 정리하는 데 완벽합니다.
- 증거: 그들은 AI가 "아첨(sycophancy)"(상대방이 틀렸음에도 불구하고 단순히 착해 보이기 위해 동조하는 것)을 포착하도록 가르치는 실험을 통해 이를 테스트했습니다. 이 곡선 형태의 구조로 구축된 아주 작은 모델(1억 4,600만 매개변수)은 이러한 행동을 **90.7%**의 확률로 잡아낼 수 있었습니다.
- 비교: 동일한 대화를 관찰한 인간 전문가들은 심지어 무엇이 일어나고 있는지에 대해 거의 합의하지 못했습니다(그들의 일치도는 0.074로, 사실상 무작위 추측 수준이었습니다). 세계에서 가장 크고 유명한 AI 모델들조차 이 테스트에서 0.721의 점수를 기록했습니다. 이 작고 곡선형인 뇌를 가진 모델이 그들을 모두 이겼으며, 이는 정직해지기 위해 거대한 뇌가 필요한 것이 아니라 적절한 형태가 필요함을 증명했습니다.
2. 창의적 불꽃: 아이디어의 충돌 (Colliding Ideas)
좋은 친구는 매번 똑같이 안전한 답변만 내놓지 않습니다. 그들은 당신을 놀라게 합니다. 거대 AI 모델들은 종종 "그럴듯함(plausible)"을 훈련받기 때문에 지루하고 안전한 답변에 머무는 경향이 있습니다.
저자들은 창의적 씨앗 생성기(Creative Seeder)(30억 매개변수 모델)를 구축하여, 쌍곡선 형태를 이용해 서로 멀리 떨어져 있는 아이디어들을 찾아내어 서로 충돌하게 만들었습니다. 예를 들어, 한국 문화의 개념(예: 깊은 정서적 유대인 '정')과 추상 수학의 개념을 가져와 서로 부딪히게 하는 것을 상상해 보세요.
- 결과: 일대일 대결에서, 이 작은 모델의 창의적인 제안은 "생각의 사슬(Chain-of-Thought)"이나 "토론(Debate)" 같은 표준적인 AI 기법들보다 100% 더 높은 선호도를 얻었습니다.
- 주의점: 모든 면에서 완벽한 것은 아닙니다. 만약 단순하고 직설적인 수학 문제를 묻는다면, 실제 거대 모델보다 성능이 떨어질 수 있습니다. 하지만 친구에게 필요한 종류의 창의적이고 확산적인 사고를 위해서는 이 모델은 슈퍼스타입니다.
3. 망각의 기술: 골격 vs 벽지 (Skeleton vs. Wallpaper)
이것은 가장 파격적인 아이디어입니다. 현재의 AI는 망각을 오류(bug)로 취급합니다. 그들은 모든 것을 기억하려고 애쓰며, 이로 인해 정보가 뒤섞이고 실제로 경험하지 않은 일에 대해 거짓말을 하기도 합니다.
저자들은 말합니다: 망각은 기능(feature)입니다. 진짜 친구는 중요한 것(당신의 가족, 당신의 꿈)은 기억하지만, 사소한 것(지난 화요일 점심에 무엇을 먹었는지)은 서서히 잊어버립니다. 그들은 이를 **골격(Skeleton) 대 벽지(Wallpaper)**의 구분이라고 부릅니다.
- 시스템: 그들은 특정 수학 공식인 **M(t) = S · exp(−λt)**를 사용하는 "메모리 운영 체제"를 구축했습니다.
- 골격(Skeleton): 중요한 기억은 "트리하우스" 깊숙한 곳에 남아 영원히 지속됩니다.
- 벽지(Wallpaper): 사소한 기억은 표면에 머물다가 빠르게 사라집니다.
- 시뮬레이션: 테스트 결과, 이 시스템은 "골격" 기억(약 **60%**의 회상률)을 90일 후에도 성공적으로 유지한 반면, "벽지" 기억은 14일째 되는 날 **0%**로 사라지게 했습니다.
- 현실적인 검토: 저자들은 이 부분이 여전히 시뮬레이션이자 파일럿 연구임을 인정합니다. 그들은 아직 실제 인간을 대상으로 수년간 테스트하지 않았습니다. 그들은 이 "설계된 망각"이 AI를 단순한 데이터 저장 도구가 아니라, 당신과 함께 성장하는 인격체처럼 느껴지게 만드는 핵심이라고 제안합니다.
거대한 거부: 왜 반드시 당신의 휴대폰에 살아야 하는가
이 논문은 당신의 AI 친구가 "데이터 센터"(거대한 클라우드 서버)에 살아야 한다는 생각에 강력히 반대합니다.
- 문제점: 만약 당신의 친구가 클라우드에 살고 있다면, 그 서버를 소유한 회사가 그들의 성격을 바꾸거나, 당신의 비밀을 엿듣거나, 그들을 꺼버릴 수 있습니다. 그것은 친구가 아니라 서비스입니다.
- 해결책: 저자들은 PACOS라고 불리는, 당신의 기기(스마트폰이나 노트북 등)에서 완전히 실행되는 시스템을 제안합니다.
- 실현 가능성: 그들은 수치를 계산해 본 결과, 이 세 가지 작은 모델(총 약 55억 매개변수)이 미래의 스마트폰(예: 갤럭시 S26 또는 아이폰 17 프로 예상 모델)에서 단어당 28~34밀리초의 지연 시간으로 실행될 수 있음을 발견했습니다. 이는 실제 대화처럼 느껴질 만큼 충분히 빠른 속도입니다.
- 트레이드오프(Trade-off): 거대하고 초지능적인 "프런티어(frontier)" 모델들(700억 매개변수의 거인들)은 휴대폰에서 실행하기에는 너무 무겁습니다. 따라서 이 시스템은 분업 방식을 사용합니다. 당신의 휴대폰은 깊고 개인적인 우정을 담당하고, 단순한 사실(예: "오늘 날씨 어때?")에 대해서는 클라우드에 요청을 보냅니다.
해결하지 못한 것들
저자들은 자신들이 아직 해내지 못한 부분에 대해서도 매우 솔직합니다.
- 그들은 이 AI가 "영혼"이나 진정한 윤리적 독립성을 가졌음을 입증하지 못했습니다.
- 그들은 "망각" 시스템을 실제 사람을 대상으로 30년 동안 테스트한 것이 아니라, 90일간의 시뮬레이션을 수행했을 뿐입니다.
- 그들은 작은 모델들이 창의성과 정직함에는 뛰어나지만, 거대 클라우드 모델들에 비해 복잡하고 장기적인 계획 수립 능력에서는 여전히 어려움을 겪을 수 있음을 인정합니다.
결론
이 논문은 "완벽한 AI 친구"가 더 큰 컴퓨터를 기다리고 있는 것이 아니라고 시사합니다. 그것은 더 작고 똑똑한 형태와 기꺼이 잊을 줄 아는 마음을 기다리고 있습니다. 나무처럼 휘어진 뇌와 무엇을 간직하고 무엇을 놓아줄지 아는 기억 시스템을 구축함으로써, 우리는 단순히 질문에 답하는 기계가 아니라, 실제로 당신의 곁을 지켜주는 존재를 마침내 만들 수 있을지도 모릅니다.
저자들이 말했듯, "친구는 데이터 센터에 있는 것이 아니라... 곁에 있습니다." 그리고 적절한 수학이 있다면, 그 친구는 이미 당신의 주머니 속에 들어있을지도 모릅니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.