← 최신 논문
🤖 AI

ParaTool: Shifting Tool Representations from Context to Parameters

ParaTool는 문맥 내 예제에서 전용 로드 가능한 매개변수 모듈로 도구 표현을 전환하여 대규모 언어 모델이 긴 문맥에 의존하지 않고도 도구 호출을 수행하면서도 우수한 성능과 감소된 계산 복잡성을 달성할 수 있게 하는 새로운 프레임워크입니다.

원저자: Zekai Yu, Qi Meng, Qizhi Chu, Yu Hao, Chuan Shi, Cheng Yang

게시일 2026-05-29
📖 3 분 읽기☕ 가벼운 읽기

원저자: Zekai Yu, Qi Meng, Qizhi Chu, Yu Hao, Chuan Shi, Cheng Yang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

상상해 보세요. 언어 이해 능력은 탁월하지만 매우 건망증이 심한 비서 (AI) 가 있다고 가정해 봅시다. 이 비서는 계산기, 날씨 앱, 비행기 예약 시스템과 같은 특정 도구를 실제로 사용해 본 적은 없지만, 언어를 이해하는 데는 놀라울 정도로 뛰어납니다.

이 비서에게 도구를 사용하게 하려면, 현재 표준 방법은 **맥락 학습 (In-Context Learning, ICL)**입니다. 이는 질문을 할 때마다 비서에게 50 페이지 분량의 거대한 사용 설명서와 20 개의 예시 이야기 뭉치를 handing 하는 것과 같습니다.

  • 문제점: 이는 누군가가 귀에 전체 사전 내용을 외쳐대면서 소설을 읽으려는 것과 같습니다. 느리고, 컴퓨터에게 지치게 만들며 (높은 비용), 비서는 종종 모든 추가 텍스트에 혼란을 느껴 실수 (할루시네이션) 를 범합니다.

이 논문의 저자들인 ParaTool은 완전히 다른 접근 방식을 제안합니다. 설명서를 비서의 '작업 기억 (맥락)'에 밀어 넣는 대신, 뇌를 약간 다시 써서 비서에게 그 기술을 영구적으로 가르치는 것입니다.

다음은 요리사의 주방 비유를 사용하여 ParaTool 의 작동 방식을 세 가지 간단한 단계로 분해한 것입니다:

핵심 아이디어: "레시피 읽기"에서 "근육 기억"으로

1. 매개변수 도구 사전 학습 ("전문 앞치마")
주방에 있는 모든 도구마다 다른 앞치마가 있다고 상상해 보세요 (베이킹용, 그릴용, 다지기용 등).

  • 기존 방식에서는 요리할 때마다 앞치마에 적힌 레시피를 읽어야 했습니다.
  • ParaTool 에서는 각 도구의 "지식" (레시피) 을 가져와 특정 경량 앞치마의 직물 자체에 직접 짜 넣습니다.
  • 기술적으로, 그들은 도구의 지시사항을 AI 에 부착할 수 있는 작고 전문화된 숫자 집합 (매개변수) 으로 변환합니다. 이제 AI 는 설명서를 읽을 필요가 없습니다. 그냥 앞치마를 "입으면" 지식이 즉시 존재하는 것입니다.

2. 소프트 도구 선택 ("스마트 수석 요리사")
이제 이러한 전문 앞치마들이 한 무더기 쌓여 있습니다. 고객이 요리를 주문하면 올바른 앞치마를 골라야 합니다.

  • 기존 방식 (하드 선택): 정확히 어떤 앞치마가 맞는지 추측해야 합니다. "그릴" 앞치마를 "베이킹" 주문에 선택하면 요리가 망가집니다.
  • ParaTool 방식 (소프트 선택): "수석 요리사" (작은 게이트 네트워크) 가 주문을 보고 "좋아, 이건 60% 는 그릴 같고 40% 는 베이킹 같네"라고 말합니다. 하나만 고르는 대신, 두 가지 앞치마의 혼합물을 입힙니다.
  • 왜 이것이 멋진가: 요리사가 추측에서 약간의 실수를 하더라도, AI 는 여전히 올바른 앞치마의 일부를 입고 있습니다. AI 의 고유한 지능이 그 차이를 "느껴" 코스를 수정할 수 있습니다. 단일 추측에 모든 것을 걸기보다 훨씬 견고합니다.

3. 매개변수 도구 미세 조정 ("연습 주행")
마지막으로, AI 가 이러한 혼합 앞치마를 사용하여 요리를 해보는 연습 세션을 진행합니다. 이는 AI 가 동시에 입고 있는 서로 다른 "기술"들을 어떻게 조율할지 배우도록 도와주며, 실제로 고객을 대할 때 지시사항을 매끄럽게 어떻게 혼합해야 하는지 정확히 알 수 있도록 보장합니다.

결과: 더 빠르고, 더 똑똑하며, 더 저렴함

이 논문은 두 가지 주요 테스트 세트 (Stable ToolBench 및 BFCL) 에서 기존 "설명서 읽기" 방식과 이를 비교 테스트했습니다.

  • 성능: ParaTool 은 정확도가 훨씬 높았습니다. 긴 문서를 읽는 방식에 의존한 방법들보다 더 많은 작업을 올바르게 해결했습니다.
  • 효율성: 이것이 가장 큰 승리입니다. AI 가 매번 수천 단어의 지시사항을 읽을 필요가 없기 때문에 필요한 컴퓨터 작업량이 90% 이상 감소했습니다.
    • 비유: 이는 승객에게 지도를 소리 내어 읽으며 운전하는 것 (느리고 산만함) 과 경로를 외우고 운전하는 것 (빠르고 매끄러움) 의 차이와 같습니다.

이것이 중요한 이유 (논문에 따르면)

저자들은 도구 지식을 "맥락" (읽는 텍스트) 에서 "매개변수" (AI 의 내부 뇌) 로 이동시킴으로써 두 가지 큰 문제를 해결했다고 주장합니다:

  1. 속도: AI 가 텍스트에 빠져들지 않기 때문에 훨씬 더 빠릅니다.
  2. 신뢰성: AI 가 길고 지저분한 지시사항에 혼란을 느끼지 않기 때문에 실수가 줄어듭니다.

또한 한 가지 제한 사항도 지적합니다: 현재 AI 는 도구를 사용하기 전에 해당 도구에 대해 "학습"해야 합니다. 준비 없이 전혀 본 적 없는 새로운 도구를 그냥 볼 수는 없습니다. 하지만 AI 가 이미 알고 있는 도구들에 대해서는 더 이상 설명서를 볼 필요가 없는 장인처럼 수행합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →