Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content
이 논문은 언어 모델이 이 소외된 커뮤니티 특유의 언어를 정확하게 이해하고 정의할 수 있는 능력을 평가하기 위해, 118개의 퀴어 속어에 대한 수동으로 큐레이션된 데이터셋이자 분류 체계인 Slang-Q를 소개한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
인터넷을 거대한, 북적이는 도시라고 상상해 보세요. 그곳의 모든 동네는 저마다의 비밀스러운 악수법, 내부 농담, 그리고 특별한 어휘를 가지고 있습니다. 과학의 세계에는 자연어 처리(NLP)라는 분야가 있는데, 이는 '거대 언어 모델(LLM)'이라 불리는 디지털 두뇌를 구축하여 이 도시를 읽고 이해하도록 만듭니다. 이 모델들을 세상에 존재하는 거의 모든 책과 웹사이트를 읽은 초스마트한 관광객이라고 생각해 보세요. 하지만 이들은 특정 동네의 현지 속어(slang)를 이해하는 데 가끔 어려움을 겪습니다. LGBTQIA+ 커뮤니티는 하나의 동네인데, 이곳은 단어가 누구에 의해 어디에서 쓰이느냐에 따라 매우 다른 의미를 가질 수 있는 풍부하고 창의적이며 빠르게 변화하는 언어를 가지고 있습니다. 만약 이 디지털 관광객들이 속어를 잘못 이해한다면, 친근한 인사를 모욕으로 오해하거나 농담의 핵심을 완전히 놓칠 수도 있습니다. 이것은 중요한 문제입니다. 왜냐하면 이 모델들이 사람들이 정보를 찾고, 친구와 대화하며, 웹을 탐색하는 데 점점 더 많이 사용되고 있기 때문입니다. 만약 이 모델들이 소외된 공동체의 언어를 이해하지 못한다면, 모두에게 공정하게 서비스를 제공할 수 없습니다.
여기, 이 디지털 관광객들이 '퀴어 속어(Queer Slang)' 동네를 얼마나 잘 알고 있는지 테스트하기로 결정한 연구팀이 있습니다. 그들은 'Slang-Q'라고 불리는 특별한 **평가 지표(evaluation ground)**를 구축했습니다. 이것은 마치 118개의 특정 퀴어 용어와 그 용어들이 실제로 사용된 1,024개의 실제 문장이 짝을 이룬, 거대하고 정교하게 조직된 사전과 같습니다. 결정적으로, 이 단어 목록은 문장들과 독립적으로 만들어졌습니다. 이는 모델들이 단순히 정답을 암기하지 못하도록 하기 위함입니다. 연구진은 모델들에게 단순히 추측하라고 요구한 것이 아니라, 모델들이 이 단어들을 올바르게 정의할 수 있는지 확인하기 위해 일련의 도전 과제들을 설정했습니다. 연구진은 네 가지 다른 방식의 질문법을 테스트했습니다. 때로는 단어만 제시하기도 했고(예: "'tea'가 뭐야?"라고 묻는 것처럼), 때로는 단어와 함께 그것이 어떻게 쓰였는지 보여주는 문장을 함께 제시했습니다(예: "내가 파티에 대해 'tea'를 쏟아냈어(spilling the tea)'라고 하는 것처럼). 또한 모델들에게 두 가지 다른 '마스크(mask, 역할)'를 부여했습니다. 하나는 모델이 일반적인 언어 전문가처럼 행동하게 하는 것이었고, 다른 하나는 모델에게 퀴어 인터넷 속어 전문가로서 행동하라고 지시하는 것이었습니다.
결과는 마치 적절한 교과서로 공부하지 않고 시험을 치르는 학생을 보는 것과 같았습니다. 맥락이나 특별한 지시 없이 속어의 정의를 묻는 질문을 받았을 때, 모델들은 자주 비틀거렸습니다. 모델들은 퀴어 특유의 의미 대신 단어의 가장 흔하고 일상적인 의미를 선택하는 경 경향이 있었습니다. 예를 들어, 'bear(곰)'에 대해 묻는다면, 모델은 게이 커뮤니티 내의 특정 유형의 사람 대신 털이 많은 동물이라고 생각할 수 있습니다. 하지만 이야기는 연구진이 모델들에게 약간의 도움을 주었을 때 바뀌었습니다. 문장을 통해 단어가 어떻게 사용되었는지 맥락을 제공하거나, 모델에게 "이봐, 너는 퀴어 속어 전문가야"라고 말해주었을 때, 모델들은 올바른 의미를 맞히는 데 훨씬 더 능숙해졌습니다. 이는 마치 모델들이 단어의 사전적 정의는 알지만, 친구들이 파티에서 실제로 어떻게 사용하는지는 맥의를 잡기 위해 약간의 맥락 힌트가 필요한 사람과 같았습니다.
연구진은 모델들이 점점 똑똑해지고 있지만, 여전히 완벽하지는 않다는 것을 발견했습니다. 최선의 힌트를 주더라도, 모델들은 커뮤니티에서 자라난 인간 전문가의 수준에는 미치지 못했습니다. 모델들은 단어가 원래 모욕이었으나 커뮤니티에 의해 긍정적인 의미로 재탈환(reclaimed)된 것인지, 혹은 특정 문화 집단과 특정한 연결 고리가 있는지와 같은 미묘한 문화적 뉘앙스를 놓치는 경우가 많았습니다. 흥상스럽게도, 연구진은 모델들이 학습 데이터에서 정답을 단순히 암기했는지 여부도 확인했습니다. 그들은 일부 모델들, 특히 상용 모델들은 이러한 특정 문장들을 이전에 '본 적이 있는' 것처럼 보였던 반면, 오픈 소스 모델들은 그렇지 않았다는 것을 발견했습니다. 하지만 정답을 암기하지 않은 모델들도 적절한 맥락이 주어진다면 그것들을 파악해낼 수 있었습니다.
결국, 이 논문은 우리의 디지털 두뇌가 강력하기는 하지만, 퀴어 커뮤니티의 활기차고 변화무쌍한 언어를 진정으로 이해하기 위해서는 약간의 안내가 필요하다는 점을 시사합니다. 모델들은 단순히 일반적인 사전에 의존해서는 안 됩니다. 그들은 "이곳은 특별한 동네이고, 이곳 주민들은 이렇게 말한다"라는 말을 들어야 합니다. 이 연구는 문제를 영원히 해결했다고 주장하는 것이 아니라, 적절한 맥락과 프레임을 제공하는 것이 엄청난 차이를 만든다는 것을 보여줍니다. 이는 진정으로 도움이 되는 AI를 만들기 위해서는 단어뿐만 아니라, 그 뒤에 숨겨진 문화와 이야기까지 가르쳐야 한다는 점을 상기시켜 줍니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.