← 최신 논문
💻 computer science

Veritas: A Semantically Grounded Agentic Framework for Memory Corruption Vulnerability Detection in Binaries

Veritas 는 리프트된 LLVM IR 의 정적 분석, 이중 뷰 LLM 추론, 그리고 런타임 검증을 결합하여 스트립된 바이너리에서 메모리 손상 취약점을 높은 재현율과 낮은 오탐률로 탐지하는 의미 기반의 다중 에이전트 프레임워크로, 이전에 알려지지 않은 Apple 취약점을 성공적으로 식별했습니다.

원저자: Xinran Zheng, Alfredo Pesoli, Marco Valleri, Suman Jana, Lorenzo Cavallaro

게시일 2026-05-15
📖 4 분 읽기☕ 가벼운 읽기

원저자: Xinran Zheng, Alfredo Pesoli, Marco Valleri, Suman Jana, Lorenzo Cavallaro

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

"Veritas" 논문을 쉬운 언어와 창의적인 비유로 설명합니다.

큰 문제: "분실된 번역"

상상해 보세요. 공장에서 제작된 복잡한 기계 (컴퓨터 프로그램) 가 있다고 가정해 봅시다. 공장은 원래 설계도 (소스 코드) 를 보관하지만, 실제로 받는 기계는 모든 라벨, 지시사항, 도면이 제거된 간소화된 블랙박스 버전 (바이너리) 입니다.

보안 전문가들은 이러한 블랙박스에서 "메모리 손상" 버그를 찾아야 합니다. 이는 해커가 침입할 수 있도록 기계의 기초에 숨겨진 균열과 같습니다.

문제는 설계도 없이 기계의 작은 부분 (예: 누르는 버튼) 이 상자 내부 수 마일 떨어진 위험한 부분 (예: 압력 밸브) 과 어떻게 연결되는지 파악하는 것이 매우 어렵다는 점입니다.

구식 방법: AI 로 추측하기

최근 사람들은 이러한 블랙박스를 살펴보기 위해 강력한 AI(대형 언어 모델) 를 사용하기 시작했습니다. AI 는 똑똑합니다. 기계의 "지저분한" 코드를 읽고 균열이 있을 곳을 추측해 볼 수 있습니다.

그러나 이 논문은 AI 가 흐릿한 사진만 가진 탐정과 같다고 주장합니다. AI 는 형태를 볼 수는 있지만, 한 선이 파이프에 연결된 것인지 전선에 연결된 것인지 확신할 수 없습니다. "사진"(바이너리 코드) 이 중요한 세부 정보를 누락하고 있기 때문에 AI 는 종종 다음과 같은 실수를 저지릅니다:

  1. 실제 균열을 놓침 (위음성).
  2. 안전한 부분을 균열로 잘못 판단함 (위양성).

해결책: Veritas(진실 추구자)

저자들은 새로운 시스템인 Veritas를 구축했습니다. AI 가 자유롭게 추측하도록 내버려 두는 대신, Veritas 는 AI 를 사실에 충실하도록 강제하는 3 단계 수사팀처럼 작동합니다.

Veritas 를 함께 일하는 세 명의 전문가 팀으로 생각해 보세요:

1 단계: 지도 제작자 (슬라이서)

AI 가 아무것도 보기 전에 특수 도구 (슬라이서) 가 블랙박스를 스캔합니다. 이는 AI 를 사용하지 않고 엄격한 수학을 사용하여 정밀한 지도를 그립니다.

  • 비유: 기계를 거대한 도시라고 상상해 보세요. 슬라이서는 도시의 99%(안전한 부분) 를 무시하고 "입구"(데이터가 들어오는 곳) 와 "위험 구역"(데이터가 사용되는 곳) 을 연결하는 단일하고 얇은 선만 그립니다.
  • 결과: 이는 AI 에게 혼란스러운 도시 전체가 아닌, 조사할 작은 집중 경로를 제공합니다. 이 경로는 데이터가 실제로 이 경로를 따라 이동한다는 "증인"(증거) 에 의해 뒷받침됩니다.

2 단계: 탐정 (이중 뷰 감지기)

이제 AI(탐정) 가 지도 제작자가 그린 경로를 살펴봅니다. 하지만 여기에는 트릭이 있습니다. AI 는 서로 다른 두 쌍의 안경을 통해 경로를 바라봅니다.

  • 안경 A(역컴파일된 코드): 이는 읽을 수 있는 영어 문장처럼 보입니다. 이는 AI 가 일어나는 일의 이야기를 이해하는 데 도움을 줍니다.
  • 안경 B(LLVM IR): 이는 원시적인 기술 설계도처럼 보입니다. 이는 AI 가 정확한 수학과 메모리 주소를 보게 도와줍니다.
  • 비유: AI 가 특정 거리 표지판에 대해 혼란스러워하면, 도로가 정확히 어디로 가는지 보기 위해 기술 설계도로 전환합니다. 이는 AI 가 수학에 맞지 않는 이야기를 만들어 내는 것을 방지합니다.

3 단계: 법의학적 검사관 (검증자)

AI 가 "여기에 균열이 있는 것 같습니다!"라고 말할 수 있습니다. 하지만 Veritas 는 그 말을 그대로 믿지 않습니다. 세 번째 에이전트 (검증자) 가 나가 기계를 물리적으로 테스트합니다.

  • 비유: AI 는 법정에서 "균열을 봤습니다"라고 증언하는 증인입니다. 검증자는 "보여 주십시오"라고 말하는 판사입니다. 검증자는 AI 가 말한 대로 기계가 실제로 고장 나는지 확인하기 위해 특수 도구 (디버거) 로 기계를 실행합니다.
  • 결과: 기계가 고장 나지 않으면 "균열"은 기각됩니다. 고장 나면 버그가 확인됩니다.

이것이 중요한 이유 (결과)

저자들은 라벨이 제거된 실제 소프트웨어에서 Veritas 를 테스트했습니다.

  • 성공률: Veritas 는 실제 버그의 **90%**를 발견했습니다.
  • 정확도: 거의 거의 0 에 가까운 오경보를 보였습니다. 버그가 존재한다고 말할 때, 그것은 거의 항상 사실이었습니다.
  • 실제 승리: 별도의 테스트에서 Veritas 는 아무도 몰랐던 애플 소프트웨어의 새로운 미확인 버그 (0-day) 를 발견했습니다. 그들은 이를 보고했고, 애플은 이를 확인하고 보안 ID(CVE) 를 부여했습니다.

결론

이 논문은 복잡하고 간소화된 소프트웨어에서 버그를 찾는 데 똑똑한 AI 만으로는 부족하다고 주장합니다. AI 에게는 **현실 기반 (Grounding)**이 필요합니다.

  • 현실 기반 없이: AI 는 마치 있을지도 모를 것을 상상하는 몽상가와 같습니다.
  • Veritas 와 함께: AI 는 과학자가 됩니다. 지도 제작자가 특정 확인 경로를 제공하고, 탐정이 두 가지 다른 도구로 세부 사항을 확인하며, 검사관이 실제 테스트로 발견 사항을 증명합니다.

엄격한 수학, 똑똑한 AI, 그리고 실제 테스트를 결합함으로써 Veritas 는 위험한 소프트웨어 버그를 찾는 것을 훨씬 더 신뢰할 수 있고 정확하게 만듭니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →