Two AI Metrics Diverged: Will it Make All the Difference?
이 논문은 프런티어 AI 역량이 부유한 행위자들에게 집중된 상태로 남을 것인지 아니면 소규모 개발자들에게까지 확산될 것인지는, 그러한 역량을 측정하는 데 사용되는 특정 성능 지표가 컴퓨팅 자원과 관련하여 수학적으로 유계(bounded)인지 또는 무계(unbounded)인지에 결정적으로 달려 있다고 주장한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
큰 질문: 부자가 더 부유해질 것인가, 아니면 모두가 따라잡을 수 있을 것인가?
인공지능의 세계를 거대한 경주라고 상상해 보세요. 한쪽에는 "프런티어(Frontier)" 주자들이 있습니다. 이들은 무제한의 자금을 가진 거대 기업들로, 매년 기하급수적으로 늘어나는 전력을 투입해 가장 비싼 슈퍼컴퓨터를 사고 그들의 AI 모델을 훈련시킵니다. 다른 한쪽에는 "미크(Meek, 약한 자)" 주자들이 있습니다. 이들은 소규모 개발자, 오픈 소스 열성가, 그리고 연구자들로, 고정된 적은 예산을 가지고 있습니다. 이들은 새로운 슈퍼컴퓨터를 살 수는 없지만, 기술의 일반적인 발전(더 좋은 도로라든지 더 빠른 신발 같은 것들)으로부터 혜택을 받습니다.
이 논문이 던지는 핵심 질문은 이것입니다: 부유한 주자들이 결국 너무 멀리 앞서 나가서 가난한 주자들이 결코 따라잡을 수 없게 될까요? 아니면 격차가 줄어들어 결국 모두가 비슷한 속도로 달리게 될까요?
이 논문의 놀라운 답변은 다음과 같습니다: 그것은 전적으로 당신이 경주를 어떻게 측정하느냐에 달려 있습니다.
두 가지 유형의 "자" (지표)
저자들은 우리가 흔oid히 서로 다른 "자"(지표)를 사용하여 AI의 발전을 측정한다고 주장하며, 이 자들은 완전히 다른 두 가지 이야기를 들려줍니다. 그들은 이 자들을 **미크 지표(Meek Metrics)**와 **마이티 지표(Mighty Metrics)**라는 두 가지 유형으로 분류합니다.
1. 미크 지표: "천장" 효과
미크 지표를 단순히 결승선에 도달하는 것이 목표인 비디오 게임 레벨이라고 생각해 보세요.
- 비유: 결승선이 100미터 앞에 있는 경주를 상상해 봅시다. "프런티어" 주자는 제트팩을 타고 10초 만에 도착합니다. "미크" 주자는 자전거를 타고 20초 만에 도착합니다.
- 함정: 프런티어 주자가 100미터 지점에 도달하면, 그들은 멈춥니다. 그들은 결승선을 '넘어서' 갈 수 없습니다. 내년에 더 좋은 제트팩을 얻더라도, 그들은 여전히 100미터 지점에 서 있을 뿐입니다. 결국 자전거 타는 사람도 100미터에 도달하게 됩니다.
- 결과: 장기적으로 보면 제트팩과 자전거 사이의 격차는 사라집니다. 둘 다 결승선에 도착해 있기 때문입니다.
- 실제 사례:
- 시험 점수 (0-100%): 모델이 시험에서 99점을 받는다면, 그보다 더 많이 맞히는 것은 사실상 불가능합니다. 저렴한 모델도 98%나 99%를 받을 수 있습니다. 격차는 좁혀집니다.
- 검증 손실 (Validation Loss): 이는 점점 작아져서 0에 수렴하는 오차의 척도입니다. 일단 0에 가까워지면, 돈을 더 많이 쓴다고 해서 더 '0'에 가깝게 만들 수는 없습니다.
논문의 주장: 만약 당신이 관심을 갖는 대상이 "미크 지표"라면, 값비싼 부유한 모델들은 결국 저렴하고 작은 모델들과 똑같이 좋아 보일 것입니다. "미크 모델들이 세상을 물려받게 될 것(The Meek models inherit the earth)"입니다.
2. 마이티 지표: "무한한 사다리" 효과
마이티 지표를 끝없이 위로 올라가는 사다리를 오르는 것이라고 생각해 보세요.
- 비유: 목표가 결승선에 도달하는 것이 아니라, 가능한 한 높이 올라가는 경주를 상상해 봅시다. "프런티어" 주자는 제트팩을 타고 1,000피트에 도달합니다. "미크" 주자는 사다리를 타고 100피트에 도달합니다.
- 함정: 천장이 없습니다. 내년에 프런티어 주자는 더 좋은 제트팩을 사용하여 10,000피트에 도달합니다. 미크 주자는 더 좋은 신발을 갖게 되더라도 겨우 200피트에 도달할 뿐입니다. 격차는 줄어들지 않고 오히려 더 넓어집니다.
- 결과: 부유한 주자는 무한히 앞서 나갑니다. "미크" 주자는 결코 따라잡을 수 없습니다.
- 실제 사례:
- 게임 랭킹 (ELO): 체스에서는 언제나 더 잘할 수 있습니다. 슈퍼컴퓨터는 인간을 이길 수 있지만, 더 강력한 슈퍼컴퓨터는 이전의 슈퍼컴퓨터를 이길 수 있습니다. '완벽한 점수'란 없으며, 언제나 더 강해질 수 있습니다.
- 작업 길이 (Task Length): AI가 수행할 수 있는 복잡한 프로젝트의 길이는 어느 정도인가요? 저렴한 모델이 1시간짜리 작업을 할 수 있다면, 부유한 모델은 10시간짜리 작업을 할 수 있습니다. 부유한 모델은 앞으로도 계속해서 100시간, 1,000시간짜리 작업을 해낼 수 있습니다. 격차(능력의 차이)는 계속 벌어집니다.
논문의 주장: 만로 당신이 관심을 갖는 대상이 "마이티 지표"라면, 부유한 모델들은 영원히 앞서 나갈 것입니다. 격차는 결코 좁혀지지 않습니다.
반전: 모든 것은 질문을 어떻게 하느냐에 달려 있다
이 논문의 가장 중요한 부분은 같은 기술이라도 질문을 어떻게 구성하느냐에 따라 미크 또는 마이티로 측정될 수 있다는 점입니다.
저자들은 소프트웨어 엔지니어링을 사용한 아주 좋은 예를 제시합니다:
- 시나리오 A (미크): "AI가 버그 없이 작동하는 코드를 작성할 수 있는가?"라고 묻습니다.
- 만약 AI가 코드의 99%를 제대로 작성한다면, 그것으로 보통 "충분히 좋다"고 간격이 생깁니다. 99% 모델과 99.9% 모델 사이의 격차는 그리 중요하지 않습니다. 이것이 미크 관점입니다.
- 시나리오 B (마이티): "AI가 실수하기 전까지 완벽하게 연속해서 작성할 수 있는 코드의 줄 수는 얼마인가?"라고 묻습니다.
- 여기서 부유한 모델은 100만 줄을 완벽하게 작성할 수 있는 반면, 저렴한 모델은 1만 줄밖에 작성하지 못할 수 있습니다. 부유한 모델은 계속 나아갈 수 있습니다. 이것이 마이티 관점입니다.
교훈: 만약 당신이 AI를 "테스트를 통과했는가?"(미크)로 측정한다면, 미래는 민주적이고 개방적입니다. 만약 당신이 "얼마나 복잡한 문제를 해결할 수 있는가?"(마이티)로 측정한다면, 미래는 소수의 부유한 이들에 의해 지배될 것입니다.
이것이 현실 세계에서 왜 중요한가
논문은 우리가 법과 정책을 만들 때 어떤 "자"를 사용하는지 매우 주의해야 한다고 결론짓습니다.
- 미크 지표를 사용한다면: 우리는 AI가 모두에게 안전하고 접근 가능해지고 있다고 생각할 수 있습니다. "이제 누구나 할 수 있다"며 규제를 완화할 수도 있습니다.
- 마이티 지표를 사용한다면: 우리는 부유한 기업들이 복잡성 측면에서 너무 멀리 앞서 나가고 있어서, 과학, 경제, 안전의 미래를 통제하며 다른 모든 이들을 뒤처지게 만들고 있다는 사실을 깨닫게 될 것입니다.
핵가 핵심 요약:
이 논문은 AI가 반드시 독점 체제가 될 것이라거나 민주주의가 될 것이라고 단정 짓지 않습니다. 답은 우리가 무엇을 가치 있게 여기느냐에 달려 있다고 말합니다.
- 만약 우리가 단순한 작업에서의 완벽한 정확도를 가치 있게 여긴다면, 격차는 좁혀질 것이고 작은 플레이어들도 따라잡을 것입니다.
- 만약 우리가 점점 더 어렵고 복잡한 문제를 해결하는 것을 가치 있게 여긴다면, 격차는 벌어질 것이고 오직 부유한 자들만이 그 도구들을 갖게 될 것입니다.
저자들은 많은 사람들이 "미크" 자(예: 시험 점수)를 보면서 격차가 좁혀지고 있다고 생각하지만, 실제로는 "마이티" 자(예: 어려운 과학 문제 해결)가 보여주는 격차가 이미 엄청나게 커지고 있다고 경고합니다. AI의 미래를 이해하려면, 적절한 자를 선택해야 합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.