CoCoDA: Co-evolving Compositional DAG for Tool-Augmented Agents
CoCoDA는 심볼릭 통합을 통한 검색 효율성 최적화와 구조 인식 보상 메커니즘을 통한 학습 가속화를 위해 단일 구성 코드 DAG 내에서 플래너와 확장 가능한 도구 라이브러리를 공진화시켜 소형 언어 모델이 더 큰 교사 모델을 능가하거나 그에 필적할 수 있도록 하는 프레임워크입니다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
상상해 보세요. 매우 똑똑하지만 작은 로봇 보조기 (플래너) 가 고급 수학 문제를 풀거나 코드를 작성하는 것과 같은 복잡한 문제를 해결해야 한다고 가정해 봅시다. 이 로봇은 한 번에 정보를 보유할 수 있는 제한된 "뇌 공간 (컨텍스트 윈도우)"을 가지고 있습니다. 이를 돕기 위해 우리는 로봇이 사용할 수 있는 기술 도구 (툴) 의 도구 상자를 제공합니다.
기존 방법들의 문제는 마치 거대한 도서관의 책들을 주머니에 들고 다니려는 것과 같습니다. 로봇을 돕기 위해 더 많은 유용한 책 (툴) 을 추가할수록 주머니는 너무 무거워지고, 로봇은 문제를 해결하기에 충분한 책들을 그 뇌에 담을 수 없게 됩니다. 또한 로봇은 이러한 책들을 어떻게 정리해야 할지 모릅니다. 로봇은 그저 지저분하게 쌓인 텍스트 뭉치만 볼 뿐이므로, 올바른 책을 빠르게 찾는 것이 어렵습니다.
CoCoDA는 도구 상자가 어떻게 구축되고 로봇이 이를 사용하는 방법을 학습하는 방식을 변경함으로써 이러한 문제를 해결하는 새로운 시스템입니다. 간단한 비유를 통해 작동 원리를 설명해 드리겠습니다.
1. "살아있는 설계도" (구성적 DAG)
지저분하게 쌓인 책 대신, CoCoDA 는 살아있는 설계도 (방향성 비순환 그래프, 즉 DAG) 를 구축합니다.
- 노드: 이들은 개별 도구로 생각할 수 있습니다. 일부는 망치나 드라이버와 같은 기본 도구이고, 다른 일부는 기본 도구들을 결합하여 만든 "슈퍼 도구" (예: 조립된 드릴 프레스) 입니다.
- 연결: 설계도는 슈퍼 도구가 기본 도구들로 어떻게 만들어지는지 정확히 보여줍니다. 이는 "케이크" 레시피가 "반죽 섞기"와 "굽기" 단계를 가리키는 레시피 책과 같습니다.
- 이점: 설계도가 구조를 알고 있기 때문에 로봇은 모든 책의 모든 페이지를 읽을 필요가 없습니다. 로봇은 "목차" (시그니처) 와 "레시피 단계" (의존성) 를 살펴봄으로써 어떤 도구들이 서로 맞는지 즉시 알 수 있습니다.
2. "스마트 필터" (타입 DAG 검색)
로봇이 새로운 문제에 직면했을 때 올바른 도구를 선택해야 합니다. 기존 방법들은 도서관의 모든 도구에 대한 설명을 읽었는데, 이는 느리고 너무 많은 뇌 공간을 소모합니다.
CoCoDA 는 보안 검색대와 같이 선택지를 좁히는 4 단계 필터를 사용합니다:
- 1 단계 (신원 확인): 도구의 "신원증" (타입 시그니처) 을 확인합니다. 도구가 작업과 맞지 않으면 (예: 종이를 자르기 위해 망치를 사용하려는 경우) 즉시 거부됩니다. 이는 거의 뇌 에너지를 소모하지 않습니다.
- 2 단계 (설명 스캔): 신원 확인을 통과한 도구들에 대해, 관련성이 있는지 확인하기 위해 짧은 설명을 읽습니다.
- 3 단계 (규칙 확인): "규칙" (전제 조건 및 결과 조건) 을 확인합니다. 이 도구가 가지고 있지 않은 입력을 요구하나요? 올바른 출력을 생성할까요? 그렇지 않다면 제외됩니다.
- 4 단계 (예시 매칭): 마지막으로, 실제 작동 중인 도구의 예시를 살펴보고 절대적으로 가장 적합한 것을 선택합니다.
마법 같은 점: 비싸고 느린 단계 (1 과 2) 에서 나쁜 도구들을 먼저 걸러내기 때문에, 실제로 살아남은 소수의 도구에 대한 전체 세부 사항을 읽는 데만 비싼 "뇌 에너지"를 소비합니다. 이로써 도서관이 거대하게 커지더라도 로봇의 "주머니"가 너무 무거워지는 것을 방지합니다.
3. "공진화" (함께 학습하기)
이 부분이 가장 독특합니다. 보통 로봇은 도구를 사용하는 법을 배우지만 도구는 그대로 남아 있습니다. CoCoDA 에서는 로봇과 도구 상자가 함께 성장합니다.
- 발견: 로봇이 여러 기본 단계 ("덧셈", "곱셈", 그다음 "나눗셈"과 같이) 를 연결하여 어려운 문제를 성공적으로 해결했을 때, 더 크고 똑똑한 AI 인 "교사"가 그 성공을 살펴봅니다.
- 발명: 교사는 말합니다. "저 단계들의 시퀀스는 유용하군! 이것들을 묶어서 새로운 '슈퍼 도구'로 만들고 설계도에 추가하자."
- 보상: 로봇은 이러한 새로운 슈퍼 도구를 사용함으로써 기본 단계를 반복해서 수행할 필요가 없어지므로 보너스 점수 (보상) 를 받습니다.
- 루프: 로봇이 더 나아질수록 묶을 패턴을 더 많이 찾습니다. 도구 상자가 더 똑똑해질수록 로봇은 더 어려운 문제를 해결할 수 있습니다. 그들은 동기적으로 진화합니다.
결과
이 논문은 수학 문제, 표 분석, 코딩 작업에서 이 시스템을 테스트했습니다.
- "작은 대 큰" 테스트: 80 억 "뇌 단위"를 가진 작은 로봇과 320 억 단위를 가진 거대한 로봇을 비교했습니다.
- 결과: CoCoDA 를 사용하면 작은 로봇이 어려운 수학 및 논리 퍼즐에서 거대한 로봇과 비슷하거나 심지어 더 나은 성과를 낼 수 있었습니다.
- 효율성: 작은 로봇이 단순히 운이 좋았던 것이 아닙니다. 그것은 지식을 매우 효율적으로 조직하는 법을 배워 무거운 작업을 수행하기 위해 거대한 뇌 크기가 필요하지 않게 되었습니다.
요약하자면, CoCoDA 는 작은 AI 에게 자신의 조직적이고 위계적인 기술 도서관을 구축하도록 가르쳐, 어떤 도구를 가져야 하는지 그리고 어떻게 결합해야 하는지 정확히 알면서도 압도당하지 않고 자신의 체급을 훨씬 뛰어넘는 성과를 내도록 합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.