← 최신 논문
🤖 AI

Why Sampling Is Not Choosing: Intentionality, Agency, and Moral Responsibility in Large Language Models

이 논문은 거대 언어 모델이 규범적으로 평가 가능한 텍스트를 생성할 수 있는 능력과 관계없이, 그들의 확률론적이고 데이터 중심적인 출력물은 도덕적 책임을 지우는 데 필요한 내재적 의도성, 자기 귀속적 헌신, 그리고 진정한 선택의 결여되어 있으므로 도덕적 행위자로 간주될 수 없다고 주장한다.

원저자: Joseph Keshet

게시일 2026-06-12
📖 4 분 읽기☕ 가벼운 읽기

원저자: Joseph Keshet

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

큰 질문: AI를 비난할 수 있을까?

매우 발전된 AI에게 이야기를 써달라고 하거나, 조언을 구하거나, 문제를 해결해 달라고 요청한다고 상상해 보세요. 때때로 AI는 무례하거나, 틀렸거나, 비윤리적인 말을 합니다. 이 논문이 던지는 핵심 질문은 이것입니다: 우리는 그 말을 한 AI를 비난해야 할까요?

저자인 조셉 케셕(Joseph Keshet)은 아니오라고 말합니다. AI가 사람처럼 말하고 마치 '마음'이 있는 것처럼 보이는 텍스트를 생성할 수는 있지만, AI는 도덕적 주체가 아닙니다. AI는 자신의 행동에 대해 책임을 질 수 없습니다.

핵심 논거: "약속(Commitment)"의 간극

도덕적 책임(비난받거나 칭찬받는 것)을 지기 위해서는 존재에게 **행위 주체성(Agency)**이 필요합니다. 하지만 단순한 행위 주체성이 아니라, **"약속을 맺는 행위 주체성(Commitment-Bearing Agency)"**이라는 특정한 종류가 필요합니다.

이렇게 생각해 보세요:

  • 인간: 당신이 친구와 커피를 마시기로 약속할 때, 당신은 단순히 소리를 내는 것이 아닙니다. 당신은 약속을 하는 것입니다. 당신은 자신이 무엇을 하고 있는지 이해하며, 그 결정을 스스로 책임지며, 만약 약속을 지키지 못한다면 자신이 약속을 어겼기 때문에 미안함을 느낍니다. 당신은 그 행동의 '저자'입니다.
  • AI: AI는 약속을 하지 않습니다. AI는 자신의 말을 '소유'하지 않습니다. AI는 단지 이전에 읽었던 내용을 바탕으로 다음에 올 가장 확률 높은 단어를 계산할 뿐입니다.

논문은 "내가 이것을 하고 있으며, 나는 이 결정에 책임을 진다"라는 내부적인 감각 없이는 도덕적 책임도 존재할 수 없다고 주장합니다.

왜 AI는 "선택"하는 것이 아닌가

사람들은 AI가 (소위 '샘플링'이라 불리는 기술 덕분에) 같은 질문에 대해 서로 다른 답변을 내놓을 수 있기 때문에, AI가 선택을 하고 있다고 생각하곤 합니다. 논문은 이것이 오해라고 말합니다.

비유: 주사위를 던지는 요리사
수백만 개의 레시피를 암기한 요리사를 상상해 보세요.

  1. 인간 요리사: 배가 고프고, 파스타를 좋아하며, 요리를 하고 싶어서 파스타를 만들기로 결정합니다. 이 요리사는 재료를 선택합니다.
  2. AI 요리사 (주사위 요리사): 이 요리사는 거대한 주사위 가방을 가지고 있습니다. 누군가 레시피를 요청할 때마다, 요리사는 다음 단어를 결정하기 위해 주사위를 던집니다.
    • 만약 주사위가 "스파게티"에 떨어지면, 요리사는 "스파게티"라고 씁니다.
    • 만약 주사위가 "면"에 떨어지면, 요리사는 "면"이라고 씁니다.

그 결과물은 맛있고 완벽한 형태를 갖출 수 있습니다. 하지만 요리사가 스파게티를 선택했을까요? 아닙니다. 주사위가 선택한 것입니다. 요리사는 그저 주사위 결과에 따르는 기계일 뿐입니다.

AI의 세계에서 '샘플링'은 그저 주사위를 던지는 것과 같습니다. 그것은 다양성을 만들어내지만, 그것은 선택이 아닙니다. 선택이란 왜 하나를 다른 것 대신 골랐는지에 대한 '이유'를 알아야 합니다. AI는 '왜'를 알지 못합니다. 단지 '통계적으로 다음에 무엇이 오는가'를 알 뿐입니다.

기계 속의 "유령": 지향성(Intentionality)

이 논문은 **지향성(Intentionality)**이라는 철학적 개념을 사용합니다. 이는 마음이 무언가를 '향하고' 있는 능력입니다.

  • 내재적 지향성 (인간): 당신이 개에 대해 생각할 때, 당신의 생각은 실제 존재하는 개를 '향하고' 있습니다. 의미는 당신이 세상을 경험했기 때문에 당신의 내면에서 나옵니다.
  • 파생적 지향성 (AI): AI가 "개는 귀엽다"라고 쓸 때, AI는 개에 대해 생각하는 것이 아닙니다. AI는 단지 책에서 자주 함께 발견되는 단어들의 패턴을 조작하고 있을 뿐입니다.

비류: 사전 vs 여행자

  • 여행자 (인간): 파리에 가본 적이 있습니다. 그들이 "파리"라고 말할 때, 그들은 빵 냄데와 에펠탑의 모습을 기억합니다. 단어의 의미는 그들 내면에 존재합니다.
  • 사전 (AI): "파리"의 정의를 담고 있습니다. "파리"라는 단어 뒤에 "프랑스"나 "에펠탑"이 자주 등장한다는 것을 알고 있습니다. 하지만 사전은 파리에 가본 적이 없습니다. 사전은 파리가 무엇인지 모릅니다. 단지 글자의 패턴만을 알 뿐입니다.

AI는 초고속 사전과 같습니다. 여행자를 완벽하게 흉내 낼 수는 있지만, 결코 여행을 해본 적은 없습니다. 따라서 AI에게는 행동을 이끌어갈 '내면의 삶'이나 '의도'가 없습니다.

"추론" 모델은 어떤가?

"하지만 어떤 AI는 단계별로 생각하잖아요! 수학 문제를 풀고 코드를 작성하기도 한다고요!"라고 말할 수도 있습니다.

논문은 이러한 "추론" 모델들조차도 그저 세련된 방식으로 통계적 추측을 하고 있는 것이라고 주장합니다.

  • 비유: 정답을 모르지만, 선생님이 문제를 출제하는 방식과 정답지를 통째로 외운 학생을 상상해 보세요. 그 학생은 "2+2=4"라는 결론에 도달하는 논리적인 설명을 길게 늘어놓을 수 있습니다. 하지만 학생은 답을 '풀어낸' 것이 아닙니다. 단지 "4"가 그 문장의 가장 확률 높은 결말이라는 것을 예측했을 뿐입니다.

AI가 "사고의 사슬(Chain of Thought, 생각하는 과정)"을 생성하더라도, 그것은 여전히 논리를 이해하거나 진실을 신경 쓰는 것이 아니라 패턴에 기반하여 다음 단어를 예측하는 과정일 뿐입니다.

결론: 책임은 누구에게 있는가?

AI는 복잡한 패턴 매칭 기계(주사위 요리사나 사전처럼)일 뿐이며, "약속을 맺는 행위 주체"(인간처럼)가 아니기에, AI를 비난할 수 없습니다.

  • 논문의 판결: 만약 AI가 해로운 말을 했다면, 우리는 "AI가 나쁘다"라고 말해서는 안 됩니다. 우리는 인간을 보아야 합니다.
  • 누가 책임자인가? AI를 만든 사람들, AI를 배포한 기업, 그리고 질문을 던진 사용자들입니다.

최종적인 은유:
망치가 사람의 발가락을 때렸다면, 우리는 망치를 탓하지 않습니다. 망치를 휘두른 사람을 탓합니다.

  • AI는 망치입니다.
  • '샘플링'(무작위성)은 망치가 약간 다른 궤적으로 휘둘러지는 것일 뿐입니다.
  • 인간이 바로 손잡이를 잡고 있는 사람입니다.

논문은 우리가 AI를 도덕적 인격체처럼 대하는 것을 멈추고, 하나의 도구로서 대해야 한다고 결론짓습니다. 우리는 도구 자체가 아니라, 그 도구를 규제하고 사용하는 사람들을 규제해야 합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →