← 최신 논문
🤖 AI

Answer Engineering: Local Trajectory Editing for Protocol-Constrained Decision Making in Large Language Models

이 논문은 모델 재학습 없이도 돌발성 난청에 대한 임상 의사결정에서 상당한 정확도 향상을 달성하며, 생성 과정 중 추론 궤적에 국소적이고 규칙 기반의 개입을 적용함으로써 대규모 언어 모델의 프로토콜 준수 능력을 개선하는 결정론적 런타임 계층인 "답변 엔지니어링(Answer Engineering)"을 소개한다.

원저자: Victor Lavrenko, Anastasiia Molodnitskaia

게시일 2026-06-23
📖 3 분 읽기☕ 가벼운 읽기

원저자: Victor Lavrenko, Anastasiia Molodnitskaia

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

문제점: "자신감 넘치지만 틀린" AI

당신이 매우 똑똑하고 말솜씨가 좋은 인턴을 의료 보고서를 작성하는 데 고용했다고 상상해 보세요. 당신은 안전을 위해 그들이 반드시 따라야 하는 엄격한 체크리스트(프로토콜)를 전달했습니다.

  • 문제점: 설령 당신이 인턴에게 "체크리스트를 단계별로 따라 주세요"라고 말하더라도, 그들은 종종 자신만만하게 논리적으로 보이지만 실제로는 중요한 안전 단계를 건너뛰거나 너무 일찍 결론을 내리는 보고서를 작성합니다. 그들은 정답을 찾기 위해 규칙을 실제로 따르기보다는, 틀린 답을 정당화하는 아름다운 설명을 써 내려갈 수 있습니다.
  • 논문의 발견: 단순히 AI에게 "단계별로 생각하라(think step-by-step)"고 요청하는 것은 이 문제를 해결하지 못했습니다. 실제로 연구진의 테스트에 따르면, 이는 특정 조건(돌발성 난청)에 대한 규칙 준수율을 54%에서 25%로 떨어뜨려 오히려 상황을 악화시켰습니다.

해결책: "앤서 엔지니어링(Answer Engineering)" (실시간 편집기)

저자들은 **앤서 엔지니어링(Answer Engineering)**이라는 새로운 방법을 제안합니다. AI를 다시 학습시키는 것(비용이 많이 들고 느림)이나 단순히 잘하기를 바라는 대신, 그들은 AI와 최종 답변 사이에 위치하는 실시간 편집기를 구축했습니다.

AI의 사고 과정을 궤도를 따라 움직이는 기차라고 생각해 보세요.

  • 일반적인 AI: 기차는 그냥 앞으로 계속 나아갑니다. 만약 잘못된 방향으로 길을 들면, 막다른 길에 다다르거나 잘못된 역에 도착할 때까지 계속 진행합니다.
  • 앤서 엔지니어링: 이것은 마치 원격 제어기를 든 교통 관제사가 선로 위에 서 있는 것과 같습니다. 기차가 움직이는 동안 관제사는 모든 단계를 지켜봅니다.
    • 만약 기차가 필수 정차 지점(프로토콜 규칙)을 건너뛰려 하면, 관제사가 브레이크를 밟습니다.
    • 관제사는 기차를 마지막 안전 지점으로 약간 되감기(rewind) 합니다.
    • 관제사는 기차가 다른 경로를 택하도록 강제하거나, AI가 놓친 필수 표지판을 삽iod합니다.
    • 그 후, 기차는 교정된 지점에서 다시 출발합니다.

작동 방식 (세 가지 움직임)

논문은 이 "교통 관제사"가 AI가 글을 쓰는 동안 어떻게 수정하는지에 대한 세 가지 구체적인 방법을 설명합니다.

  1. 과거 편집하기 ("되돌리기" 버튼): 만약 AI가 규칙을 위반하는 문장(예: 증상을 확인하기도 전에 "이것은 확실히 심장마비입니다"라고 쓰는 경우)을 쓰면, 관제사는 그 문장을 삭제하고 더 안전하고 규칙을 준수하는 버전으로 대체합니다.
  2. 되감기 및 재시도 ("우회로"): 만약 AI가 잘못된 방향으로 가기 시작하면, 관제사는 AI를 마지막 교차로로 돌려보낸 뒤 "다른 방향으로 가보세요"라고 요청합니다. 관제사는 몇 가지 옵션을 테스트하고 규칙을 따르는 옵션을 선택합니다.
  3. 미래 강제하기 ("필수 표지판"): 만약 규칙상 AI가 특정 경고(예: "이것은 응급 상황입니다")를 반드시 언급해야 한다면, 관제사는 AI가 계속 진행하기 전에 해당 문구를 텍스트에 직접 삽입하여 규칙이 절대 누락되지 않도록 보장합니다.

결과: 기차 선로를 고치다

저자들은 돌발성 난청이 포함된 의료 시나리오를 통해 이를 테스트했습니다.

  • 수정 전: AI에게 단순히 "단계별로 생각하라"고 했을 때, 규칙을 준수하는 비율은 **25%**에 불과했습니다.
  • 수정 후: 실시간으로 경로를 감시하고 수정하는 "앤서 엔지니어링" 편집기를 사용하자, AI가 규칙을 준수하는 비율이 **83.5%**로 올라갔습니다.
  • 보너스 효과: 이 방법은 주요 문제만 해결한 것이 아니라, 다른 유사한 사례(전음성 난청)에서도 AI가 실수를 피하도록 도와주었습니다. 이는 시스템이 단순히 정답을 "추측"한 것이 아니라 실제로 논리를 따랐음을 증명합니다.

한계점 (제약 사항)

논문은 이 접근 방식의 한계에 대해서도 솔직하게 밝히고 있습니다.

  • 임시 방편이지 만병통치약은 아닙니다: 이 방법은 규칙이 명확하고 실수가 국소적일 때(예: 단계를 건너뛰는 경우) 가장 잘 작동합니다. 만약 AI의 근본적인 "성향" 자체가 규칙을 무시하는 것이라면 모든 것을 고칠 수는 없습니다.
  • 시간이 걸립니다: 시스템이 AI의 사고를 멈추고, 확인하고, 때로는 되감아야 하기 때문에 일반적인 AI보다 약 2.8배 느리게 작동합니다.
  • 인간이 규칙을 작성해야 합니다: 관제사가 집행할 "교통 법규"(규칙)를 작성하는 데는 여전히 인간 전문가가 필요합니다. 시스템이 스스로 규칙을 만들어내는 것이 아니라, 규칙을 집행할 뿐입니다.

핵심 요약

이 논문은 더 안전한 결과를 얻기 위해 항상 더 똑똑한 AI 두뇌를 만들 필요는 없다는 것을 보여줍니다. 때로는 AI의 작업을 실시간으로 지켜보고, 규칙을 어길 때 잡아내며, 작업이 끝나기 전에 부드럽게 올바른 궤도로 다시 안내하는 똑똑한 편집자가 필요할 뿐입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →