Synthetic Computers at Scale for Long-Horizon Productivity Simulation
본 논문은 경험적 학습을 통해 에이전트 성능을 획기적으로 향상시키고 미래의 에이전트 강화 학습을 위한 확장 가능한 기반을 제공하는 장기 생산성 시뮬레이션을 실행하기 위해 풍부한 아티팩트를 갖춘 현실적이고 사용자별 디지털 환경을 생성하는 방법론인 "Synthetic Computers at Scale"을 소개합니다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
로봇을 훌륭한 사무직원으로 가르치고 싶다고 상상해 보세요. 누군가 이메일을 타이핑하거나 스프레드시트를 작성하는 몇 가지 예시를 보여줄 수는 있습니다. 하지만 실제 사무실 업무는 단순히 타이핑하는 것을 넘어, 지저분한 디지털 책상에서 길을 찾고, 지난주에 무엇을 했는지 기억하며, 3 년 전에 만든 폴더에서 올바른 파일을 찾아내고, 간결한 이메일을 보내는 상사와 생각이 자주 바뀌는 고객과 조율하는 것입니다.
논문 "Synthetic Computers at Scale(규모화된 합성 컴퓨터)"은 실제 사람의 개인 데이터가 필요 없이 AI 에이전트에게 이러한 복잡한 기술을 가르치는 방법을 제안합니다. 그들이 어떻게 했는지 간단히 설명해 드리겠습니다.
1. "디지털 유령" 구축 (합성 컴퓨터)
예측 불가능한 방식으로 사적이고 지저분한 실제 사람의 컴퓨터를 사용하는 대신, 연구자들은 처음부터 1,000 개의 가짜 컴퓨터를 구축했습니다.
- 페르소나: 먼저 각 컴퓨터마다 "캐릭터"를 만들었습니다. 하나는 엑셀을 사랑하고 정리 정돈을 싫어하는 덴버의 시니어 재무 고문 "마가렛"일 수 있고, 다른 하나는 동일한 파일의 50 개 버전을 보관하는 그래픽 디자이너일 수 있습니다.
- 디지털 책상: 그들은 AI 를 사용하여 각 캐릭터를 위한 현실적인 폴더 구조를 구축했습니다. 빈 하드 드라이브가 아니라, 실제 인간이 수년간의 작업을 통해 생성했을 법한 가짜 스프레드시트, 오래된 프레젠테이션, 초안 등으로 채워진 "유령 파일"로 가득 차 있었습니다.
- 결과: 그들은 각자 고유한 역사, 습관, 그리고 지저분하지만 체계적인 파일 시스템을 가진 1,000 개의 독특한 디지털 세상을 만들었습니다.
2. "한 달간" 시뮬레이션
가짜 컴퓨터가 준비되면, 그들은 대규모 시뮬레이션을 실행했습니다.
- 설정: AI "관리자"가 가짜 컴퓨터를 보고 한 달 치의 현실적인 업무를 할당했습니다. 재무 고문 마가렛의 경우 투자 모델을 업데이트하고, 고객에게 보고서를 작성하며, 이사회 회의에 대비하는 것이었습니다.
- 근로자: 두 번째 AI "근로자"가 그 가짜 컴퓨터 안에 배치되었습니다. 그 임무는 마가렛처럼 행동하는 것이었습니다. 다음을 수행해야 했습니다.
- 올바른 데이터를 찾기 위해 폴더를 뒤지기.
- 작년에 무엇을 했는지 확인하기 위해 오래된 스프레드시트 열기.
- 피드백을 요청하거나 마감일을 명확히 하기 위해 (역시 AI 인) "가짜 동료"에게 이메일 보내기.
- 실수를 수정하고 문서를 수정하기.
- 규모: 이는 간단한 작업이 아니었습니다. 각 시뮬레이션은 AI 가 한 달 치의 작업을 완료하는 데 실제 시간으로 8 시간 이상의 컴퓨팅 시간이 소요되었으며, **2,000 회 이상의 단계 (턴)**가 포함되었습니다.
3. "유령" 경험에서 배우기
이 논문의 가장 중요한 부분은 시뮬레이션 이후에 일어난 일입니다.
- 부검: 연구자들은 AI 가 생성한 최종 보고서만 보지 않았습니다. 그들은 전체 여정을 살펴보았습니다. AI 가 어떻게 길을 잃었는지, 어떻게 오류에서 회복했는지, 동료들과 어떻게 대화했는지, 그리고 어디서 실수를 했는지 분석했습니다.
- "기술 카드": 그들은 이러한 교훈을 "기술 카드"로 변환했습니다. 예를 들어, 재무 에이전트들이 종종 퍼센트와 베이스 포인트를 혼동한다는 것을 발견했습니다. 그들은 그 실수를 방지하기 위한 구체적인 규칙 (기술) 을 만들었습니다.
- 테스트: 그들은 이러한 "기술 카드"를 새로운 AI 에이전트에 부여하고 새로운 가짜 컴퓨터에서 동일한 작업을 수행하도록 요청했습니다.
- 결과: "기술 카드"를 가진 AI 는 그렇지 않은 AI 보다 점수가 훨씬 높았습니다 (약 7% 높음). 실수가 적었고 복잡한 워크플로우를 훨씬 잘 처리했습니다.
4. 이것이 중요한 이유 (왜)
이 논문은 AI 를 현실 세계에서 진정으로 유용하게 만들기 위해서는 단순한 작업만 부여해서는 안 된다고 주장합니다. AI 는 맥락을 기억하고 지저분한 파일들을 처리해야 하는 복잡하고 장기적인 환경에서 훈련되어야 합니다.
- 비유: 비행 훈련을 생각해 보세요. 조종사에게 비행기를 조종하는 법만 가르치는 것이 아니라, 악천후, 엔진 고장, 그리고 혼란스러운 지시를 주는 부조종사가 있는 시뮬레이터에 투입하는 것입니다.
- 주장: 이러한 "디지털 유령" 컴퓨터를 수백만 개 만들어내면 무한한 훈련 데이터를 생성할 수 있습니다. 이를 통해 AI 는 실제 세계에 닿기 전에 안전하고 가짜인 세상에서 연습함으로써 생산적인 근로자가 되는 법을 배울 수 있습니다.
요약
연구자들은 가짜 파일과 가짜 사람으로 채워진 1,000 개의 가짜 컴퓨터를 구축했습니다. 그들은 AI 에이전트들이 이 컴퓨터들 안에서 시뮬레이션된 한 달 동안 복잡한 업무를 수행하도록 했습니다. 에이전트들이 이 과정에서 어떻게 성공하거나 실패했는지 연구함으로써, 그들은 AI 가 실제 사무실 업무를 수행하는 데 훨씬 더 똑똑해지도록 만드는 **교훈 (기술)**을 만들었습니다.
그들이 전하는 바는 다음과 같습니다: "AI 에게 훌륭한 직원이 되는 법을 가르치고 싶다면, 단순히 시험을 치르게 하지 마세요. 가짜 사무실을 만들어 한 달 동안 그곳에서 일하게 한 다음, 배운 것을 가르치세요."
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.