← 최신 논문
💻 computer science

A Non-Destructive Methodological Framework for Modernizing Legacy Clinical Reporting Systems for AI-Driven Pharmacoinformatics: A SAS Case Study

본 논문은 기존 코드를 메타데이터 레이어로 래핑하여 기계가 읽을 수 있는 출력을 생성함으로써 레거시 SAS 임상 보고 시스템을 AI 기반 약리정보학으로 현대화하는 비파괴적 방법론적 프레임워크를 제시하며, 이는 원본 소스를 변경하지 않으면서도 높은 검증 동등성과 상당한 코드 축소를 달성합니다.

원저자: Jaime Yan

게시일 2026-05-15
📖 4 분 읽기☕ 가벼운 읽기

원저자: Jaime Yan

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

제약 회사가 방대하고 오래된 설명서 도서관을 보유하고 있다고 상상해 보세요. 이 설명서들은 컴퓨터에게 신약의 안전성 데이터를 계산하고 정부로부터 신약 승인을 받기 위해 필요한 공식 보고서를 작성하는 방법을 정확하게 알려줍니다.

문제: "잠긴 상자" 도서관
수십 년간 이 설명서들 (SAS 라는 언어로 작성됨) 은 완벽하게 작동해 왔습니다. 이 설명서들은 "검증 (validated)"된 것으로, 정부가 이를 완전히 신뢰한다는 의미입니다. 그러나 큰 결함이 하나 있습니다. 이 설명서들은 최종 보고서를 PDF 나 워드 파일과 같은 예쁜 인쇄 문서로만 생성한다는 점입니다.

만약 현대적인 AI(똑똑한 로봇과 같은) 에게 이러한 보고서를 읽게 하거나 패턴을 찾게 하거나 새로운 보고서를 작성하는 데 도움을 주고 싶다면, AI 는 막히게 됩니다. AI 는 예쁜 문서를 "읽을" 수 없으며, 오직 페이지 위의 잉크만 볼 수 있을 뿐입니다. 데이터를 추출하려면 인간이 모든 것을 수동으로 다시 타이핑하거나 숫자의 의미를 추측해야 합니다. 이는 느리고 지루하며 인간의 실수에 취약합니다.

이 회사는 끔찍한 선택에 직면해 있습니다:

  1. 모두 부수기: 오래되고 신뢰받는 설명서를 버리고 처음부터 완전히 새로운 설명서를 작성합니다. 이는 위험합니다. 새로운 버전에서 아주 작은 실수를 범하면 정부가 신약 신청을 거절할 수 있기 때문입니다.
  2. 그대로 두기: 오래된 시스템을 유지하되, 그러면 AI 를 사용할 수 없으며 신약 개발은 여전히 느리게 진행됩니다.

해결책: "유리 케이스" 프레임워크
이 논문은 교묘한 세 번째 옵션을 제안합니다: 오래된 설명서를 전혀 건드리지 마십시오. 대신, 그 주변에 똑똑한 "유리 케이스"를 구축하십시오.

다음은 간단한 비유를 사용하여 이 프레임워크가 작동하는 방식입니다:

1. 번역기 (다리 지도)

오래된 설명서들이 비밀 코드로 작성되어 있다고 상상해 보세요. 프레임워크는 오래된 시스템 바로 앞에 "번역기"(Bridge Map이라고 함) 를 구축합니다. 오래된 시스템이 실행될 때, 번역기는 코드를 변경하지 않고 단지 출력되는 것을 관찰합니다. 번역기는 말합니다. "알겠습니다. 오래된 시스템이 50 명의 환자가 두통을 겪었다고 계산했습니다. 이를 컴퓨터가 읽을 수 있는 명확한 디지털 목록으로 기록하겠습니다."

2. 보편적 형식 (중간 표현)

오래된 시스템은 보통 정리되지 않은 포맷의 보고서를 내뱉습니다. 프레임워크는 그 출력을 포착하여 즉시 **Intermediate Representation(IR)**이라고 불리는 깔끔하고 구조화된 디지털 형식으로 변환합니다.

이것은 손으로 쓴 요리법 (오래된 보고서) 을 구조화된 데이터베이스 항목으로 바꾸는 것과 같습니다.

  • 옛 방식: "53 명 (61.6%) 이 여성이었습니다." (로봇이 파싱하기 어려움)
  • 새 방식: Count: 53, Percentage: 61.6, Type: Female. (로봇이 이해하기 쉬움)

이 과정은 원래 요리법을 변경하지 않고 일어납니다. 오래된 시스템이 요리를 하고, 프레임워크는 재료를 깔끔한 상자에 정리할 뿐입니다.

3. 스마트 어시스턴트 (AI 준비 상태)

이제 데이터가 이 깔끔한 디지털 상자에 들어있으므로, AI 는 마침내 자신의 일을 할 수 있습니다. 논문은 AI 에게 다음을 요청함으로써 이를 테스트했습니다:

  • 요약: "환자 연령에 대한 주요 발견 사항을 알려주세요." AI 는 즉시 디지털 상자를 읽고 요약을 작성할 수 있었습니다.
  • 오류 발견: "여기에 이상한 점이 있나요?" AI 는 약물 용량이 증가함에 따라 부작용도 증가했는데 이는 합리적이라는 점을 발견했지만, 인간들이 놓쳤을 법한 설사율의 이상한 감소를 포착했습니다.
  • 선제적 계획: "새로운 연구에 대한 규칙이 여기 있습니다. 설정 파일을 작성하세요." AI 는 규칙을 읽고 올바른 디지털 구성 파일을 생성할 수 있었습니다.

4. "다시 하기" 옵션 (통합)

논문은 또한 보너스 기능을 언급합니다. 회사가 "유리 케이스"에 익숙해지면, 오래되고 정리되지 않은 설명서를 하나씩 새로운 깔끔한 것으로 교체하기 시작할 수 있습니다.

  • 결과: 중복을 제거하고 논리를 정리함으로써 코드 라이브러리를 92% 축소했습니다 (복잡한 파일 558 개에서 단순한 파일 158 개로).
  • 주의점: AI 가 작동하게 하려면 이를 반드시 수행할 필요는 없었습니다. AI 는 오래된 시스템을 감싸는 것만으로 1 일째부터 작동했습니다.

증명: 효과가 있었나요?

연구진은 실제 방대한 산업용 도서관 (373,000 줄의 코드) 에서 이를 테스트했습니다.

  • 현실 세계 테스트: 그들은 14 가지 유형의 약물 보고서를 실행했습니다. 그중 11 개에서 새로운 시스템은 오래된 시스템의 결과와 완벽하게 일치했습니다 (또는 허용 가능한 오차 범위 내에서). 완벽하게 일치하지 않은 3 개는 수학이 잘못된 것이 아니라 레이아웃이 다르게 보였기 때문이었습니다.
  • 공개 테스트: 그들은 공개된 표준 데이터셋에서 테스트했습니다. 새로운 시스템은 5 개 보고서 모두에서 100% 완벽하게 모든 숫자를 일치시켰습니다.

결론

이 프레임워크는 오래된 클래식 카 위에 현대적인 하이테크 대시보드를 얹는 것과 같습니다. 엔진을 다시 구축할 필요가 없습니다 (이는 비용이 많이 들고 위험합니다). 현대적인 도구가 사용할 수 있는 형식으로 엔진의 힘을 번역하는 레이어만 추가하면 됩니다.

이를 통해 제약 회사는 수십 년간 의존해 온 신뢰받는 정부 승인 시스템을 버리지 않고도 신약 발견을 가속화하기 위해 AI 를 즉시 사용하기 시작할 수 있습니다. 이는 "비파괴적" 업그레이드입니다. 오래된 시스템은 안전하고 튼튼하게 유지되는 반면, 새로운 레이어는 그 잠재력을 열어줍니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →