← 최신 논문
💬 NLP

Creative Collision: Directorial Persona Steering and Competition in Large Language Models

이 논문은 상반되는 디렉터 페르소나 벡터(스필버그 대 스코세이지)를 중첩하여 한 페르소나가 종종 다른 페르소나를 압도한다는 점, 중간 단계의 혼합이 역설적으로 일관성을 향상시킨다는 점, 그리고 두 도덕적 톤이 동일한 딥 트랜스포머 레이어에 국한된다는 점을 밝혀냄으로써, 제어 가능한 창의적 생성을 위한 경쟁적 의미 방향의 기하학에 대한 새로운 통찰을 제공하는 새로운 활성화 스티어링 프레임워크인 "크리에이티브 콜리전(Creative Collision)"을 소개한다.

원저자: Subramanyam Sahoo, Justin Shenk

게시일 2026-06-16
📖 3 분 읽기☕ 가벼운 읽기

원저자: Subramanyam Sahoo, Justin Shenk

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신에게 아주 똑똑하고 창의적인, 이야기를 쓰는 로봇이 있다고 상상해 보세요. 보통은 로봇에게 특정 인물처럼 써달라고 하고 싶을 때, 단순히 "스티븐 스필버그처럼 써줘" 또는 "마틴 스코세이지처럼 써줘"라고 말하면 됩니다.

하지만 이 논문은 더 복잡하고 색다른 질문을 던집니다. 만약 우리가 로봇에게 두 감독의 스타일로 '동시에' 글을 쓰게 한다면 어떤 일이 벌어질까요?

연구진들은 이를 **"창의적 충돌(Creative Collision)"**이라고 불렀습니다. 그들은 서로 매우 다른 두 가지 "성격"이 로봇의 뇌 안에서 충돌할 때 어떤 일이 일어나는지 알고 싶어 했습니다.

두 명의 감독 (대립하는 힘)

이를 테스트하기 위해, 연구진은 도덕적 스펙트럼의 양 끝단에 위치한 두 명의 유명 영화 감독을 선정했습니다.

  • 스티븐 스필버그: <E.T.>나 <쉰들러 리스트>를 떠올려 보세요. 그의 이야기는 희망, 어린 시절의 경이로움, 구원, 그리고 해피엔딩에 관한 것입니다.
  • 마틴 스코세이지: <굿펠라스>나 <택시 드라이버>를 떠올려 보세요. 그의 이야기는 도덕적 회색 지대, 배신, 폭력, 그리고 잘못된 선택을 하는 캐릭터들에 관한 것입니다.

실험: "맛"을 섞는 법

연구진은 단순히 로봇에게 스타일을 번갈아 가며 요구한 것이 아닙니다. 대신 그들은 "조절 노브"(α\alpha라고 불리는 것)를 만들었습니다.

  • 노브를 0으로 돌리면: 로봇은 순수하게 스필버그처럼 글을 씁니다.
  • 노브를 1로 돌리면: 로봇은 순수하게 스코세이지처럼 글을 씁니다.
  • 노브를 0.5로 돌리면: 로봇은 동시에 50%의 스필버그와 50%의 스코세이지가 되려고 노력합니다.

그들은 노브를 작은 단계로 돌리며 로봇이 생성한 이야기에서 어떤 현상이 일어나는지 관찰했습니다.

거대한 발견들

1. 스필버그는 "헤비급 챔피언"이다
가장 놀라운 발견은 스필버그의 스타일이 믿기 힘들 정도로 압도적이라는 것이었습니다. 연구진이 스코세이지의 스타일을 많이 섞으려고 시도했을 때도(스코세이지를 최대 75%까지 섞었음에도!), 이야기는 여전히 대부분 스필버그처럼 느껴졌습니다.

  • 비유: 밝은 오렌지색 페인트가 가득 담긴 커다란 양동이에 검은 잉크 한 방울을 떨어뜨리는 것을 상상해 보세요. 검은 잉크를 아무리 많이 넣어도 양동이는 여전히 오렌지색입니다. 로봇의 내면에 자리 잡은 "낙관주의"는 너무 강력해서, 노브를 100% 스코세이지 쪽으로 돌리지 않는 한 "어둠"을 삼켜버립니다.

2. "일관성의 계곡" (최적의 지점)
보통 로봇에게 본래 의도하지 않은 일을 강요하면, 로봇은 실수를 하거나 횡설수설하기 시작합니다. 두 가지 상반된 스타일을 섞으면 로봇이 혼란에 빠져 이야기가 엉망이 될 것이라고 예상하기 쉽습니다.

  • 놀라운 점: 연구진이 두 감독을 중간 지점(스코세이지 25%~50%)에서 섞었을 때, 이야기는 오히려 로봇에게 순수하게 스코세이지가 되라고 강요했을 때보다 더 명확하고 일관성 있게 나타났습니다.
  • 비유: 무거운 상자를 밀고 있는 상황을 생각해 보세요. 만약 상자를 정면으로만 힘껏 밀면 상자가 넘어질 수 있습니다. 하지만 두 개의 약간 다른 각도에서 동시에 밀면, 힘이 서로 상쇄되어 상자를 안정적으로 유지해 줄 수 있습니다. 두 스타일의 "충돌"이 로봇이 궤도를 벗어나지 않도록 도와준 것입니다.

3. "도덕적 증폭기"
스타일을 약간만 섞었을 때(스코세이지 약 25%), 이야기는 단순히 지루한 혼합물이 되지 않았습니다. 이야기는 도덕적으로 복잡해졌습니다.

  • 비유: 순수한 스필버그가 화창한 날이라면, 순수한 스코세이지는 폭풍우입니다. 하지만 "충돌" 구간은 빛의 아름다움과 구름의 어둠을 동시에 볼 수 있는 드라마틱한 노을과 같습니다. 로봇은 희망과 비극이 동시에 일und happening하는 이야기를 만들어냈으며, 이는 단일 감독의 스타일보다 더 풍부하고 흥미로운 도덕적 톤을 형성했습니다.

4. 뇌의 어디에서 이런 일이 일어나는가?
연구진은 이 성격의 변화가 로봇의 "뇌"(40개의 처리 층으로 구성됨) 어디에서 발생하는지 살펴보았습니다.

  • 발견: 연구진은 28번째 층(전체 뇌의 약 70% 지점)에 있는 특정 "제어실"을 찾아냈습니다. 이곳은 로봇이 이야기의 "도덕적 톤"을 결정하는 곳입니다. 행복한 스필버그의 분위기와 어두운 스코세이지의 분위기가 바로 이 동일한 장소에 존재하며, 서로 반대 방향을 향하고 있었습니다.

이것이 왜 중요한가?

이 논문은 로봇의 학습 과정(인터넷으로부터 배운 것)이 로봇을 자연스럽게 "선하고 희망적인" 이야기 쪽으로 기울게 만들었음을 시사합니다. 어둡고 냉소적인 이야기를 쓰게 하려면 엄청난 힘이 필요합니다.

하지만 "창의적 충돌" 방식은, 만약 당신이 복잡하고 흥미로운 무언가를 만들고 싶다면, 항상 로봇에게 100% 한 가지 스타일이 되라고 강요할 필요는 없다는 것을 보여줍니다. 때로는 상반되는 두 아이디어를 부드럽게 섞는 것이, 이야기가 안정적이고 일관되며 정서적으로 깊이 있는 "최적의 지점"을 만들어냅니다.

요약하자면: 로봇은 깨기 힘든 강력한 "선한 주인공" 편향을 가지고 있습니다. 하지만 "선한 주인공"의 손을 완전히 놓지 않은 채, "악당"의 영역으로 살짝 밀어붙이기만 해도, 가장 흥미롭고 일관되며 도덕적으로 복잡한 이야기들을 얻을 수 있습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →