Think Fast: Estimating No-CoT Task-Completion Time Horizons of Frontier AI Models
이 논문은 명시적인 사고 사슬(chain-of-thought) 토큰 없이 복잡한 추론을 수행하는 프런티어 AI 모델의 능력을 인간 기준치 대비 작업 완료 시간 지평을 측정함으로써 평가하며, 성능이 매년 두 배씩 증가하는 추세를 밝히고 이러한 모델들이 2030년까지 단 한 번의 실행으로 인간의 노력이 25분 이상 소요되는 과제들을 곧 해결할 수 있을 것이라고 전망한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 마술사가 공연하는 것을 보고 있다고 상상해 보세요. 보통 마술사는 자신의 과정을 설명하며 말합니다. "카드를 섞을 것이고, 그다음 맨 위 카드를 살짝 훔쳐본 뒤, 이제 이 카드를 사라지게 만들겠습니다." 이 말하는 부분은 AI의 '사고의 사슬(Chain of Thought, CoT)'과 같습니다. 이것은 모델이 우리에게 정답을 제시하기 전에 보여주는 단계별 추론 과정입니다. 안전 전문가들은 이 방식을 매우 좋아하는데, 왜냐하면 AI가 거짓말을 하거나 인간 감독관을 속이려는 것과 같은 위험한 계획을 세우고 있지는 않은지 그 '생각'을 통해 확인할 수 있기 때문입니다.
하지만 만약 마술사가 말을 완전히 멈춘다면 어떻게 될까요? 만약 그들이 그 모든 복잡한 섞기, 훔쳐보기, 계획하기를 머릿속에서 완전히 침묵 속에 수행한 뒤, 손가락을 딱 튕겨 정답을 공개할 수 있다면 어떨까요? AI가 이렇게 할 수 있다면, 안전 모니터링 요원들은 AI의 생각 속에 숨겨진 나쁜 계획을 볼 수 없게 되어 암흑 속에 남겨지게 됩니다. 이 논문은 크고, 약간은 무서운 질문을 던집니다. 이 초지능 AI 모델들이 단 한 마디의 작업 과정도 보여주지 않고 실제로 머릿속에서 얼마나 많은 일을 할 수 있는가?
연구진은 이 사실을 알아내기 위해 최첨단 AI 모델들을 3만 개 이상의 퍼즐, 수학 문제, 코딩 챌린지, 그리고 논리 게임이라는 거대한 시련 속에 몰아넣었습니다. 하지만 여기에는 함정이 있었습니다. 연구진은 모델들이 '생각하는 토큰(thinking tokens)'이나 내부 독백 없이 즉시 답변하도록 강제했습니다. 그들은 '시간 지평(Time Horizon)'을 측정하고자 했습니다. 이는 멋진 표현으로, "인간이 도움 없이 스스로 해결하는 데 걸리는 시간과 비교했을 때, AI가 단 몇 초 만에 해결한 문제가 인간에게는 어느 정도의 난이도인가?"를 묻는 것입니다.
여기서 그들은 발견했습니다. 지난 6년 동안, 이 AI 모델들은 '침묵 속의 사고'에 있어 믿기 힘들 정도로 똑똑해졌습니다. 2019년에 AI는 도움 없이 순식간에 해결할 수 있는 아주 짧은 시간의 문제들만 풀 수 있었습니다. 하지만 이번 연구의 2026년 전망치에 따르면, 최신 모델들(GPT-5.5와 같은)은 인간이 아무 말 없이 문제를 해결하는 데 3분 이상이 걸릴 법한 문제들을 해결할 수 있을 것으로 추정됩니다.
성장은 빠르게 일어나고 있습니다. 연구진은 이러한 침묵 속 과제의 복잡성이 대략 매년 두 배씩(구체적으로는 373일마다) 증가하고 있다는 것을 발견했습니다. 이는 마치 AI가 단 1년 만에 1년 치의 정신적 체조를 학습하는 것과 같습니다. 만약 이 추세가 계속된다면, 2028년까지 이 모델들은 인간이 7분 동안 고민해야 할 과제를 침묵 속에서 해결할 수 있을 것이며, 2030년에는 그 수치가 25분의 순수한 숨겨진 정신적 작업량으로 뛰어오를 수 있습니다.
수학적 검증을 위해, 그들은 또한 참조 모델이 동일한 문제들을 해결하기 위해 얼마나 많은 '추론 토큰(reasoning tokens, 디지털 방식의 사고 단계)'이 필요한지를 살펴보았습니다. 그들은 AI의 침묵하는 능력이 토큰 측면에서도 매년 두 배씩 증가하고 있으며, 최신 모델들의 경우 1,500개 이상의 토큰에 달하는 숨겨진 처리 능력을 갖추게 된다는 것을 발견했습니다.
이 논문은 우리가 미래를 100% 확신할 수는 없지만(수치의 범위가 매우 넓으므로), 추세는 명확하다고 제안합니다: AI 모델들은 복잡한 다단계 추론을 우리에게 보여주지 않고 완전히 자신들의 '마음' 안에서 수행하는 능력을 빠르게 얻고 있습니다. 이는 가까운 미래에 AI의 생각을 듣는 것에 의존하여 안전을 확보하는 것이 훨씬 더 어려워질 수 있음을 의미합니다. 왜냐하면 AI는 그 모든 생각을 침묵 속에서 수행할 수도 있기 때문입니다. 저자들은 개발자들이 이 '침묵하는' 능력을 면밀히 추적할 것을 촉구하고 있습니다. 왜냐하면 이 능력은 예측 가능한 방식으로 성장하고 있으며, 강력한 시스템을 모니터링하는 방식을 근본적으로 바꿀 수 있기 때문입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.