← 최신 논문
💬 NLP

Asynchronous Reasoning: Training-Free Interactive Thinking LLMs

본 논문은 위치 임베딩을 활용하여 대규모 언어 모델이 실시간으로 동시에 사고하고 청취하며 응답을 생성할 수 있게 함으로써 추론 정확도를 유지하면서 지연 시간을 크게 줄이는 '비동기 추론'이라는 학습이 불필요한 방법을 소개합니다.

원저자: George Yakushev, Nataliia Babina, Masoud Vahid Dastgerdi, Vyacheslav Zhdanovskiy, Denis Kuznedelev, Alina Shutova, Max Ryabinin

게시일 2026-05-14
📖 3 분 읽기☕ 가벼운 읽기

원저자: George Yakushev, Nataliia Babina, Masoud Vahid Dastgerdi, Vyacheslav Zhdanovskiy, Denis Kuznedelev, Alina Shutova, Max Ryabinin

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

전화로 친구와 대화하면서 어려운 수학 문제를 풀려고 상상해 보세요.

기존 방식 (현재의 AI):
현재 대부분의 똑똑한 AI 비서는 매우 정중하지만 느린 학생처럼 작동합니다. 질문을 받으면 완전히 침묵합니다. 눈을 감고 몇 분 동안 깊이 생각한 뒤, 노트에 전체 해답을 적어내고 그제야 입을 열어 최종 답을 말합니다. 생각하는 도중에 새로운 정보로 방해하려 하면, 그들은 생각을 멈추고 무엇을 생각하던지 잊어버린 뒤 처음부터 다시 시작해야 합니다. 이는 주문을 받고 주방으로 들어가 모든 요리를 침묵 속에서 완성한 뒤, 100% 준비될 때까지 기다렸다가 음식을 내는 웨이터와 같습니다. 중간에 생각이 바뀌면 그들은 음식을 버리고 다시 시작해야 합니다.

새로운 방식 (AsyncReasoning):
이 논문은 AsyncReasoning이라는 AI 의 새로운 작동 방식을 소개합니다. 이제 AI 는 생각, 듣기, 말하기를 동시에 할 수 있는 숙련된 멀티태스커가 됩니다.

간단한 비유로 작동 방식을 설명해 보겠습니다:

"듀얼 스트림" 주방

AI 를 두 개의 별도 스테이션을 가진 셰프로 상상해 보세요:

  1. 생각하는 사람 (비밀 주방): 셰프가 힘든 작업을 하는 곳입니다. 야채를 다지고, 소스를 맛보고, 레시피를 구상합니다. 아무도 이를 볼 수 없으며, 이는 비공개입니다.
  2. 쓰는 사람 (서빙 카운터): 셰프가 당신과 대화하는 곳입니다. 요리를 접시에 담고 준비된 요리를 즉시 당신에게 건네줍니다.

그들이 어떻게 함께 작동하는지:

  • 동시 행동: "생각하는 사람"이 메인 요리를 위한 복잡한 수학을 여전히 구상하는 동안, "쓰는 사람"은 이미 전채 요리를 제공하거나 해답의 첫 단계를 설명하기 시작할 수 있습니다.
  • 일시 정지 버튼: "생각하는 사람"이 문제의 까다로운 부분을 해결하기 위해 더 많은 시간이 필요하다고 깨닫으면, "일시 정지" 버튼을 누를 수 있습니다. "쓰는 사람"은 몇 초간 말을 멈추고 새로운 생각이 준비되기를 기다린 뒤, 새로운 정보로 즉시 말을 재개합니다.
  • 생각하면서 듣기: 새로운 세부 사항 (예: "아, 사실 저는 견과류 알레르기가 있어요") 으로 방해받으면, AI 는 전체 프로세스를 멈추지 않아도 됩니다. "생각하는 사람"은 비밀 레시피에 그 새로운 정보를 즉시 반영할 수 있는 반면, "쓰는 사람"은 이미 안전한 부분들에 대해 계속 이야기할 수 있습니다.

이것이 왜 중요한가요?

이 논문은 이 방법이 AI 를 재학습 (새로운 언어를 가르치는 것과 같음) 시키지 않고도 다음 세 가지 주요 작업을 수행한다고 주장합니다:

  1. 훨씬 더 빠릅니다: 첫 단어를 기다리게 하는 대신, AI 는 5 초 이내에 말을 시작할 수 있습니다. "침묵 시간"을 최대 12 배까지 줄입니다.
  2. 여전히 똑똑합니다: 생각하면서 말하더라도 지능을 잃지 않습니다. 여전히 느리고 침묵하는 버전과 마찬가지로 어려운 수학 및 논리 문제에 대한 정확한 답을 얻습니다.
  3. 더 안전합니다: AI 는 비밀 "생각하는 사람" 스트림에서 "위험한" 아이디어를 확인할 수 있습니다. "생각하는 사람"이 요청이 안전하지 않다고 깨닫는 경우 (예: 폭탄 만드는 법을 묻는 경우), "쓰는 사람"에게 즉시 멈추라고 지시하여 유해한 단어가 당신의 귀에 도달하는 것을 막을 수 있습니다.

비밀 소스: "위치 마법"

AI 는 어떤 스트림이 무엇인지 어떻게 알까요? 논문은 AI 가 **위치 임베딩 (positional embeddings)**을 포함한 특별한 수학적 트릭을 사용한다고 설명합니다 (문장에서 단어가 어디에 속하는지 AI 에게 알려주는 보이지 않는 라벨이라고 생각하세요).

일반적으로 AI 는 단어를 엄격한 줄로 읽습니다: 단어 1, 단어 2, 단어 3.
이 새로운 방법은 AI 가 두 개의 다른 줄을 동시에 보도록 속입니다:

  • 시점 A (쓰는 사람): 생각하기 전에 말한 것처럼 대화를 봅니다.
  • 시점 B (생각하는 사람): 말하기 전에 생각한 것처럼 대화를 봅니다.

이 보이지 않는 라벨을 약간 이동시킴으로써 AI 는 혼란 없이 두 스트림을 동시에 처리할 수 있으며, 새로운 학습이 전혀 필요하지 않습니다.

요약

간단히 말해, 이 논문은 AI 가 "침묵하는 생각자"가 되는 것을 멈추고 "대화형 생각자"가 되도록 가르칩니다. 이는 AI 가 대화를 유지하고, 실시간으로 당신의 말을 듣고, 절대적으로 필요할 때만 멈추게 하여, 계산하는 동안 멈추는 컴퓨터 프로그램보다는 인간 파트너처럼 느끼게 합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →