← 최신 논문
💬 NLP

Copy-Paste to Mitigate Large Language Model Hallucinations

이 논문은 RAG(검색 증강 생성) 환경에서 LLM의 환각 현상을 줄이기 위해, 모델이 제공된 문맥을 더 많이 복사하여 답변하도록 유도하는 'CopyPasteLLM' 학습 방식과 프롬프팅 기법을 제안하여 적은 데이터로도 문맥 충실도와 정확도를 획기적으로 높였음을 보여줍니다.

원저자: Yongchao Long, Xian Wu, Yingying Zhang, Xianbin Wen, Yuxi Zhou, Shenda Hong

게시일 2026-02-10
📖 2 분 읽기☕ 가벼운 읽기

원저자: Yongchao Long, Xian Wu, Yingying Zhang, Xianbin Wen, Yuxi Zhou, Shenda Hong

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

📚 상황 설정: "교과서 vs 내 머릿속 지식"

우리가 인공지능에게 질문을 던지는 것은, 학생에게 **"여기 교과서(Context)가 있으니까, 이걸 보고 답해봐"**라고 하는 것과 같습니다. 그런데 인공지능은 두 가지 지식을 가지고 있어요.

  1. 교과서 지식 (외부 지식): 지금 눈앞에 펼쳐진 참고 자료.
  2. 내 머릿속 지식 (내부 지식): 그동안 공부해서 머릿속에 저장된 기억.

문제는 여기서 발생합니다. 만약 교과서에는 "사과는 파란색이다"라고 적혀 있는데, 학생의 머릿속에는 "사과는 빨간색이다"라는 기억이 강하게 남아 있다면? 학생은 교과서를 무시하고 **"사과는 빨간색입니다!"**라고 당당하게 거짓말을 합니다. 이게 바로 AI의 **'환각(Hallucination)'**입니다.


✂️ 해결책: "Copy-Paste (복사해서 붙여넣기) 전략"

연구진은 아주 단순하지만 강력한 아이디어를 냈습니다.
"학생이 자기 생각을 말하게 하지 말고, 그냥 교과서 문장을 그대로 베껴 쓰게 만들자!"

이것이 바로 이 논문의 핵심인 'Copy-Paste' 방식입니다.

1. 1단계: "베껴 쓰기 연습" (Prompting)

먼저 AI에게 특별한 규칙을 줍니다. "네 생각을 섞지 말고, 교과서에 있는 문장을 그대로 가져와서 답을 만들어봐."

  • CP-Order: 교과서 문장들을 순서대로 나열하기.
  • CP-Link: 문장 사이에 아주 짧은 연결 고리만 만들기.
  • CP-Refine: "더 많이 베껴 써!"라고 선생님(Reviewer)이 잔소리하며 계속 수정하기.

2. 2단계: "베껴 쓰는 습관 몸에 익히기" (Training)

단순히 시키기만 하면 귀찮아서 또 자기 생각을 말할 수 있죠? 그래서 AI에게 **'보상'**을 줍니다.
"교과서 문장을 많이 베껴 쓸수록(Copying Degree가 높을수록) 너는 아주 똑똑한 학생이야!"라고 가르치는 '선호도 학습(DPO)' 과정을 거칩니다. 이렇게 하면 AI는 이제 굳이 시키지 않아도 **"교과서에 적힌 대로 말하는 것이 가장 안전하고 올바른 길이다"**라는 것을 스스로 깨닫게 됩니다.


🚀 결과: "거짓말쟁이에서 모범생으로"

이 방법을 적용했더니 놀라운 결과가 나왔습니다.

  • 압도적인 정확도: 기존의 다른 방식들보다 거짓말을 훨씬 적게 하고, 교과서 내용에 충실한 답변을 내놓았습니다. (정확도가 최대 24.5%나 향상!)
  • 가성비 끝판왕: 엄청나게 많은 데이터를 공부시킬 필요 없이, 단 365개의 샘플만으로도 기존의 수만 개 데이터를 쓴 모델들보다 훨씬 똑똑해졌습니다. (적은 양으로 핵심을 찌르는 공부법!)
  • 메커니즘의 발견: 연구진은 AI의 뇌(내부 상태)를 들여다보니, 이 AI가 똑똑해진 이유가 "새로운 지식을 배운 것"이 아니라, **"자기 머릿속의 고집(내부 지식)을 꺾고 교과서를 믿기로 결심했기 때문"**이라는 것을 밝혀냈습니다.

💡 요약하자면?

이 논문은 AI에게 **"네 생각은 잠시 접어두고, 눈앞의 자료를 그대로 '복사해서 붙여넣기(Copy-Paste)' 하는 습관을 길러주면, 거짓말을 획기적으로 줄일 수 있다"**는 것을 증명한 연구입니다.

이제 AI는 "아는 척"하는 대신, **"자료에 이렇게 적혀 있습니다"**라고 말하는 믿음직한 비서가 된 것입니다! 🤖✨

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →