← 최신 논문
💬 NLP

Canvas-of-Thought: Grounding Reasoning via Mutable Structured States

이 논문은 기존 Chain-of-Thought(CoT) 방식의 선형적이고 수정 불가능한 한계를 극복하기 위해, HTML Canvas를 외부 추론 기질로 활용하여 원자적 CRUD 연산과 시각적 피드백 루프를 통해 상태를 직접 수정하고 정교화할 수 있는 새로운 멀티모달 추론 패러다임인 'Canvas-of-Thought(Canvas-CoT)'를 제안합니다.

원저자: Lingzhuang Sun, Yuxia Zhu, Ruitong Liu, Hao Liang, Zheng Sun, Caijun Jia, Honghao He, Yuchen Wu, Siyuan Li, Jingxuan Wei, Xiangxiang Zhang, Bihui Yu, Wentao Zhang

게시일 2026-02-12
📖 2 분 읽기☕ 가벼운 읽기

원저자: Lingzhuang Sun, Yuxia Zhu, Ruitong Liu, Hao Liang, Zheng Sun, Caijun Jia, Honghao He, Yuchen Wu, Siyuan Li, Jingxuan Wei, Xiangxiang Zhang, Bihui Yu, Wentao Zhang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

1. 기존 AI의 문제점: "지워지지 않는 화이트보드와 끝없는 낙서"

기존의 AI(Chain-of-Thought 방식)가 문제를 푸는 방식은 마치 **'한 줄로 길게 이어지는 일기 쓰기'**와 같습니다.

  • 비유: 여러분이 수학 문제를 풀 때, 연습장에 풀이 과정을 한 줄 한 줄 적어 내려간다고 상상해 보세요. 그런데 중간에 계산을 틀렸습니다! 기존 방식에서는 그 틀린 부분을 지울 수가 없습니다. 틀린 내용을 그대로 둔 채, "아까 틀렸는데 사실은 이렇습니다..."라고 구구절절 설명을 덧붙이거나, 아예 처음부터 다시 써야 합니다.
  • 문제점: 글이 길어질수록 AI는 자기가 앞에서 무슨 말을 했는지 헷갈리기 시작합니다(환각 현상). 마치 낙서가 가득한 종이 위에서 길을 찾는 것과 같죠. 특히 도형이나 그림처럼 '공간'이 중요한 문제를 풀 때, 글로만 설명하다 보니 "삼각형의 각도가 이렇다"라고 말하면서 정작 그림은 엉뚱하게 그리는 실수를 자주 합니다.

2. 새로운 해결책: "스마트한 디지털 캔버스"

이 논문에서 제안하는 Canvas-CoT는 AI에게 단순히 글을 쓰는 종이가 아니라, **'언제든 수정 가능한 디지털 캔버스(HTML Canvas)'**를 손에 쥐여준 것입니다.

  • 비유: 이제 AI는 일기장이 아니라, **'포토샵'이나 '파워포인트'**를 사용하는 디자이너가 됩니다.
  • 핵심 기능 1 (CRUD - 자유로운 수정): 이제 AI는 틀린 부분이 생기면 전체를 다시 쓰는 게 아니라, 틀린 도형의 색깔만 바꾸거나(Modify), 잘못된 선을 지우고(Delete), 새로운 점을 콕 찍어 넣을 수 있습니다(Insert). 마치 레이어(Layer)를 나누어 작업하듯, 필요한 부분만 '싹둑' 잘라 고칠 수 있는 것이죠.
  • 핵심 기능 2 (시각적 피드백 루프): AI가 캔버스에 그림을 그리면, 옆에서 **'깐깐한 검토관(Critic)'**이 실시간으로 그림을 확인합니다. "야, 너 아까는 삼각형이라고 해놓고 왜 그림은 사각형으로 그려놨어?"라고 시각적으로 지적해 줍니다. AI는 이 지적을 듣고 즉시 그림을 수정합니다.

3. 요약하자면?

이 논문의 핵심은 **"AI의 생각을 '글자'라는 1차원적인 선에서 '그림과 구조'라는 2차원적인 공간으로 옮긴 것"**입니다.

  • 기존 방식: "A는 B다. (아, 틀렸다) 다시 말하자면 A는 C다..." (비효율적, 헷갈림)
  • Canvas-CoT: "A를 그린다 \rightarrow (그림 확인) \rightarrow "어? 모양이 이상하네? \rightarrow (해당 부분만 수정) \rightarrow "완벽해!" (효율적, 정확함)

4. 결과는 어땠나요?

연구팀이 이 방식을 수학 문제, 기하학 문제, 그리고 복잡한 그림 그리기(SVG 코딩) 테스트에 적용해 본 결과, 기존 방식보다 훨씬 더 정확하고, 훨씬 더 적은 양의 데이터(토큰)를 사용하면서도 똑똑하게 문제를 풀어냈습니다.

한 줄 요약: "AI에게 '말'로만 설명하게 하지 말고, '수정 가능한 그림판'을 주고 직접 그리면서 고쳐나가게 했더니 훨씬 똑똑해졌다!"는 내용입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →