← 최신 논문
🤖 AI

From Silos to Systems: Process-Oriented Hazard Analysis for AI Systems

이 논문은 모델의 불투명성과 구성 요소 간의 상호작용과 같은 고유한 과제들을 해결하기 위해 시스템 이론적 프로세스 분석(STPA) 방법을 변형하여, 세 가지 사례 연구를 통해 검증된 방식대로 AI 개발 과정에서의 시스템 수준의 위험 요소를 식별하고 완화하는 프로세스 지향적 위험 분석 프레임워크인 PHASE를 소개한다.

원저자: Shalaleh Rismani, Roel Dobbe, AJung Moon

게시일 2026-07-02
📖 4 분 읽기☕ 가벼운 읽기

원저자: Shalaleh Rismani, Roel Dobbe, AJung Moon

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

거대한 복잡한 집의 누수를 고치려고 한다고 상상해 보십시오. 과거에 안전 전문가들은 단 하나의 파이프나 밸브만을 개별적으로 살펴보곤 했습니다. 그들은 "이 파이프가 충분히 튼튼한가?"라고 물었습니다. 만약 파이프가 멀쩡해 보인다면, 그들은 집이 안전하다고 선언했습니다. 하지만 종종 집은 여전히 침수되곤 했는데, 이는 파이프가 약한 밸브에 연결되어 있었거나, 혹은 물을 트는 사람이 새로운 시스템 사용법을 몰랐기 때문이었습니다.

이 논문은 **인공지능(AI)**이 바로 그 집과 같다고 주장합니다. 우리는 단순히 AI의 "두뇌"(모델)만 점검하고 안전하다고 결론 내릴 수 없습니다. 우리는 전체 시스템을 살펴봐야 합니다. 즉, 그것을 만든 사람들, 그들에게 입력된 데이터, 그들이 설정한 규칙, 그리고 실제 인간이 그것과 어떻게 상호작용하는지를 모두 보아야 합니다.

다음은 연구진이 수행한 작업과 발견한 내용을 일상적인 비유를 사용하여 쉽게 풀어낸 요약입니다.

문제점: "사일로(Silo)"의 함정

현재 우리가 AI의 안전성을 점검할 때, 우리는 흔히 "사일로" 안에서 작업합니다.

  • 데이터 팀은 데이터를 점검합니다.
  • 모델 팀은 코드를 점검합니다.
  • 사용자 팀은 인터페이스를 점검합니다.
    그들은 자신들의 부분이 어떻게 결합되어 전체 시스템을 망가뜨릴 수 있는지에 대해 서로 대화하는 경우가 거의 없습니다. 이는 마치 요리사, 웨이터, 설거지 담당자가 각각 별개의 방에서 일하는 것과 같습니다. 음식이 식었을 때, 고객이 불평하기 전까지는 누구의 책임인지 아무도 알 수 없습니다.

해결책: STPA와 PHASE

저자들은 원자력 발전소나 항공기에서 수십 년 동안 사용되어 온 안전 방법론(STPA)을 가져와 이를 AI에 맞게 변형했습니다. 그들은 이 AI 특화 버전을 PHASE(AI 시스템을 위한 프로세스 중심 위해 분석)라고 부릅니다.

STPA를 집의 마스터 설계도라고 생각하십시오. 단순히 벽돌이 튼튼한지 확인하는 대신, 이 설계도는 재앙이 발생하기 에 물, 전기, 사람의 모든 이동 경로를 추적하여 어디서 문제가 생길 수 있는지 강제로 찾아내게 합니다.

그들은 이 설계도를 세 가지 매우 다른 "집"(AI 시스템)에 테스트했습니다:

  1. 의료 경고 시스템 (선형 회귀): 연기가 보이기 전에 화재(패혈증)를 예측하는 연기 감지기와 같습니다.
  2. 자동 인슐린 펌프 (강화 학습): 버튼을 누르지 않아도 인슐린 용량을 스스로 조절하는 자율 주행 자동차와 같습니다.
  3. AI 아트 생성기 (트랜스포머): 예술가들이 스토리보드를 만들기 위해 사용하는, 텍씨로부터 이미지를 만들어내는 마법의 붓과 같습니다.

발견한 내용 (4가지 초능력)

이 "설계도" 접근 방법을 통해, 연구진은 PHASE가 다른 방법들이 놓치는 네 가지 특별한 초능력을 제공한다는 것을 발견했습니다.

1. 전체 그림 보기 (시스템 수준의 탐지)

  • 비유: 자동차 사고를 상상해 보십시오. 전통적인 점검 방식은 "브레이크는 정상이었고 엔진도 정상이었다"라고 말할 것입니다. 하지만 PHASE는 "운전자가 브레이크를 너무 과신했는가? 도로가 자동차 설정에 비해 너무 미끄러웠던 것은 아닌가?"라고 묻습니다.
  • 결과: PHASE는 시스템의 서로 다른 부분들이 상호작용할 때 발생하는 위험을 포착합니다. 예를 들어, 어떤 의료 AI는 99%의 정확도를 가질 수 있지만, 의사가 AI가 경고를 보냈는지 이해하지 못한다면 의사는 경고를 무시하거나 패닉에 빠질 수 있습니다. 여기서 위험은 수학적 계산이 아니라, 수학과 인간 사이의 관계에 있습니다.

2. "사회적" 위해 요소 계산하기 (단순한 부품 고장 그 이상)

  • 비유: 로봇 팔이 부서지는 것은 기술적 실패입니다. 하지만 로봇 팔이 특정 동네 출신 사람들만 채용하도록 프로그래밍되었다면, 그것은 사회적 실패입니다.
  • 결과: PHASE는 단순히 죽음이나 기계의 고장이 아닌 "손실(Losses)"을 목록화하도록 강제합니다. 여기에는 프라이버시의 상실, 창의성의 상실, 또는 신뢰의 상실 등이 포함됩니다. 이는 AI가 물리적인 것뿐만 아니라 사회적인 방식으로도 사람에게 해를 끼칠 수 있음을 인정하는 것입니다.

3. "누가 책임자인가?" 지도 (추적 가능한 책임 소재)

  • 비유: 큰 사무실에서 실수가 발생했을 때, 모두가 "내 잘못이 아니다"라고 말합니다. PHASE는 정확히 누가 그 실수를 막을 수 있는 권한을 가졌는지 보여주는 지도를 그립니다.
  • 결과: 이는 명확한 책임 체인을 만듭니다. 만약 AI가 유해한 이미지를 생성했다면, 지도는 다음과 같이 보여줍니다: 예술가가 프롬프트를 잘못 입력했는가? 안전 필터가 작동하지 않았는가? 아니면 회사가 비용 절감을 위해 필터 기준을 너무 낮게 설정했는가? 이는 어디에서 통제가 무너졌는지 정확히 보여줌으로써 "책임 전가 게임"을 방지합니다.

4. "성장통" 관찰하기 (창발적 위해 요소)

  • 비유: 아이는 성장하고 변화합니다. 2살 아이에게는 안전했던 장난감이 5살 아이에게는 위험할 수 있습니다. AI도 마찬가지입니다. AI는 학습하고 변화합니다.
  • 결과: 전통적인 안전 점검은 첫날 찍은 스냅샷과 같습니다. 반면 PHASE는 비디오 카메라입니다. 이는 AI가 재학습되거나, 업데이트되거나, 혹은 제작자가 상상하지 못한 방식으로 사용될 때 나타나는 새로운 위험을 분석가가 관찰할 수 있도록 돕습니다.

핵심 결론

이 논문은 우리가 AI를 단순히 "똑똑한 컴퓨터 프로그램"으로 보는 것을 멈춰야 한다고 결론짓습니다. 우리는 AI를 코드, 사람, 규칙, 그리고 문화가 혼합된 **사회기술적 시스템(Sociotechnical System)**으로 취급해야 합니다.

PHASE 가이드를 사용함으로써, 우리는 개별 부품을 고립시켜 점검하는 단계에서 벗어나, 실제 세상에서 전체 기계가 어떻게 작동하는지(그리고 어떻게 망가질 수 있는지)를 이해할 수 있습니다. 이는 AI가 단순히 기술적으로 정확할 뿐만 아니라, 실제로 사회에 안전하게 구축되도록 돕습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →