Practical Judgment, Virtue, and Intuition in the Use of Opaque AI-Enabled Systems
이 논문은 불투명한 자율 AI 시스템을 둘러싼 윤리적 및 법적 우려가 실천적 판단, 덕성, 직관과 같은 비정량적 인간 역량을 우선시함으로써 효과적으로 완화될 수 있다고 주장하며, 기술적 불투명성과 사회적 규범 사이의 간극을 이러한 특성들이 어떻게 메우는지 보여주기 위한 주요 사례로서 군사 영역을 제시한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 규칙은 모르는 언어로 쓰여 있고, 게임 엔진은 '블랙박스'인 고난도의 비디오 게임을 플레이하고 있다고 상상해 보십시오. 당신은 입력값(버튼을 누르는 것)과 출력값(캐릭터가 점프하는 것)은 볼 수 있지만, 그 상자 안의 코드가 어떻게 점프를 결정했는지는 전혀 알 수 없습니다. 이제 똑같은 블랙박스가 탱크를 운전하거나, 드론을 조종하거나, 스스로 생사가 걸린 결정을 내리고 있다고 상상해 보십시오. 이것이 바로 **불투명한 AI(Opaque AI)**의 세계입니다. 즉, 작동은 하지만 그 내부 작동 방식은 숨겨져 있고, 예측 불가능하며, 인간이 완전히 이해하는 것이 거의 불가능한 시스템을 말합니다.
이 논문의 저자인 네이선 가브리엘 우드(Nathan Gabriel Wood)와 앤드류 P. 레베라(Andrew P. Rebera)는 우려하고 있습니다. 그들은 이렇게 묻습니다. 만약 우리가 기계가 어떻게 생각하는지 볼 수 없고, 기계가 스스로 행동할 수 있다면, 우리는 어떻게 그것이 끔찍한 실수를 저지르는 것을 막을 수 있을까요?
문제: "블랙박스"와 "오토파일럿"
불투명성을 마술사의 속임수라고 생각해 보십시오. 당신은 토끼가 나타나는 것은 보지만, 그 메커니로직은 볼 수 없습니다. 기계가 "불투명"할 때, 심지어 그 제작자들조차 왜 특정 출력을 선택했는지 항상 설명할 수 있는 것은 아닙니다. 여기에 **자율성(Autonomy)**이 더해지면 상황은 무서워집니다.
보안 카메라(불투명한 시스템)가 사람을 포착하여 "위협"으로 분류하는 상황을 상상해 보십시오.
- 시나리오 A (인간이 통제하는 경우): 카메라는 사람을 포착합니다. 인간 경비원이 경고를 보고 영상을 확인하니, 그저 수영복을 입은 사람(소위 "벌거벗은 병사" 시나리오)임을 깨닫고 경보를 중단합니다. 인간이 실수를 잡아낸 것입니다.
- 시나리오 B (자율적인 경우): 카메라는 로봇 병사와 연결되어 있습니다. 카메라는 수영복을 입은 남자를 위협으로 분류하고, 누구에게도 묻지 않고, 로봇 병사는 발사합니다. 시스템이 불투명하기 때문에 아무도 그것이 그런 실수를 저지를 것이라고 예상하지 못했고, 자율적이기 때문에 인간이 제때 "정지" 버튼을 누를 수도 없었습니다.
이 논문은 단순히 더 나은 기술(예: 설명 가능한 AI 또는 XAI)로 이를 해결하려는 시도는 충분하지 않다고 주장합니다. 때로는 수학 자체가 너무 복잡해서 설명할 수 없거나, 시스템이 설명이 작성되기도 전에 너무 빠르게 변해버려 설명이 무용지물이 되기도 합니다.
해결책: "도덕적 조종사(Virtuous Pilot)"
블랙박스를 투명하게 만들려고 노력하는 대신(그것이 불가능할 수도 있으므로), 저자들은 기계가 할 수 없는 단 한 가지 것, 즉 인간의 직관과 인격에 의지할 것을 제안합니다.
그들은 신비로운 자율 기계에 대한 최선의 방어책은 실천적 판단력, 덕성(Virtue), 그리고 직관을 갖춘 인간이라고 제안합니다.
이것은 개를 훈련시키는 것과 비슷하다고 생각하십시오. 당신은 개에게 "공이 빨간색이면 가져오고, 파란색이면 무시하라"와 같은 경직된 규칙 책을 프로그래밍하지 않습니다. 당신은 경험, 반복, 그리고 신뢰의 유대를 통해 개를 훈련시킵니다. 결국, 개는 특이한 상황에서도 어떻게 행동해야 할지 "좋은 판단력"을 갖게 됩니다.
저자들은 군인(및 기타 전문가들)도 이와 유사하게 훈련되어야 한다고 주장합니다. 그들은 용기, 정직, 절제와 같은 "도덕적 인격"을 길러야 합니다. 이를 통해 그들은 다음을 수행할 수 있습니다:
- "분위기"를 감지하기: 숙련된 동물 사육사가 동물의 귀가 미세하게 떨리는 것만 보고도 동물이 튀어나갈 것을 아는 것처럼, 숙련된 인간 운영자는 AI 시스템이 이상하게 작동할 때 코드의 내용을 보지 않고도 그 기운을 감지할 수 있습니다.
- "벌거벗은 병사"를 식별하기: 기계는 목욕하는 사람을 보고 "타겟"이라고 생각할 수 있습니다. 하지만 좋은 판단력을 가진 인간은 맥락을 보고 "잠깐, 저건 위협이 아니야"라고 생각합니다.
- "아니오"라고 말할 때를 알기: 가장 중요한 판단은 시스템을 사용할지 말지를 결정하는 것입니다.
판단력은 유한한 배터리입니다
여기 이 논문의 핵심적인 반전이 있습니다. 판단력은 하나의 자원입니다. 그것은 마치 배터리와 같습니다.
당신이 어려운 결정을 내릴 때마다 당신의 "판단력 배터리"는 소모됩니다. 만약 당신이 피곤하거나, 스트레스를 받거나, 압도당해 있다면, 배터리는 빠르게 소모됩니다. 만약 배터리가 0이 되면, 당신은 위험한 실수를 하기 시작합니다.
저자들은 불투명한 AI를 사용하는 새로운 규칙을 제 제안합니다. 당신의 판단력 배터리가 다 되어갈 때만 블랙박스를 켜십시오.
- 만약 당신에게 충분한 에너지와 시간이 있다면, 당신 자신의 뇌를 사용하십시오.
- 만약 상황이 너무 긴박해져서, 당신이 모든 것을 직접 하려다 보니 발생하는 치명적인 오류 때문에 번아웃이 오기 직전이라면, 그때 비로소 일부 과업을 불투명한 AI에게 넘길 수 있습니다.
이것은 AI가 더 "똑똑하기" 때문에 제어권을 넘기는 것이 아닙니다. 이것은 당신의 인간 정신이 한계에 도달했을 때 AI를 비상용 백업으로 사용하는 것에 관한 것입니다. 만약 당신에게 여전히 충분한 판단력이 남아 있을 때 AI를 사용한다면, 당신은 귀중한 인간의 기술을 낭비하고 있으며 "탈숙련화(de-skilling, 스스로 하는 법을 잊어버리는 것)"의 위험을 감수하는 것입니다.
이 논문이 말하고자 하는 것이 아닌 것
이 논문이 약속하지 않는 것을 아는 것이 중요합니다:
- 이 논문은 AI가 안전하다고 말하는 것이 아닙니다. 저자들은 이러한 시스템이 위험하고 예측 불가능하다는 점을 인정합니다.
- 이 논문은 우리가 "블랙박스"를 고칠 수 있다고 말하는 것이 아닙니다. 그들은 많은 현대적 AI 시스템에 있어 완전한 투명성은 불가능하다고 주장합니다.
- 이 논문은 규칙이 쓸모없다고 말하는 것이 아닙니다. 규칙과 기술적 해결책은 여전히 필요하지만, 그것만으로는 충분하지 않습니다.
- 이 논문은 누구나 이 일을 할 수 있다고 말하는 것이 아닙니다. 논문은 명시적으로, 만약 어떤 사람이 필요한 인격(정직함, 자기 성찰, 용기)이나 판단력을 갖추지 못했다면, 그들에게 이러한 시스템을 배치하도록 허용해서는 안 된다고 밝히고 있습니다. 사실, 그들의 상관은 그들로부터 그 결정을 박탈해야 합니다.
"스위스 치즈" 안전 모델
저자들은 "스위스 치즈 모델"이라는 시각적 아이디어로 결론을 맺습니다. 안전이 스위스 치즈 덩어리라고 상상해 보십시오. 각 층(규칙, 기술, 훈련)에는 구멍이 있습니다. 만약 그 구멍들이 일직선으로 정렬되면 재앙이 발생합니다.
저자들은 인간의 덕성과 판단력 또한 또 다른 치즈 조각이라고 제안합니다. 그것들이 모든 구멍을 막지는 못할 것이며, 모든 재앙을 막지도 못할 것입니다. 하지만 기술적 해결책과 제도적 규칙 위에 이들을 쌓아 올리면, 구멍들이 일직선으로 정렬될 가능성이 낮아집니다.
요약하자면: 우리는 항상 기계 내부를 볼 수 없으며, 기계가 무엇을 할지 항상 예측할 수도 없습니다. 하지만 인간이 현명하고 정직하며 자기 인식을 갖추도록 훈련하고, 진정으로 압도당했을 때만 이 신비로운 기계들을 사용하도록 함으로써, 우리는 위험이 비극으로 변하는 것을 막을 수 있습니다. 이것은 마법 같은 해결책이 아닙니다. 그것은 인간이 루프 안에 있는 가장 영리하고 신중한 부분이 되도록 만드는 방법입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.