← 최신 논문
🤖 AI

Tuning the Stochastic Machine: A Systems Engineer's Operating Model for Human-AI Engineering

30년의 시스템 엔지니어링 경험을 바탕으로, 본 논문은 반복되는 LLM의 오류가 도구의 한계보다는 운영상의 규율 부족에서 기인한다고 주장하며, 버전 관리, 모니터링, 폐기와 같은 전통적인 시스템 관리 개념을 인간-AI 엔지니어링을 효과적으로 제어하기 위해 적응시킨 7가지 원칙의 운영 모델을 제안한다.

원저자: George Andrikopoulos

게시일 2026-08-20
📖 4 분 읽기☕ 가벼운 읽기

원저자: George Andrikopoulos

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

현대 인공지능의 세계에서, 이러한 도구들을 다루는 전문가들에게는 특정한 종류의 좌절감이 흔하게 나타나고 있습니다. 숙련된 엔지니어나 작가는 AI 어시스턴트가 저지른 미세한 실수를 바로잡기 위해 몇 시간을 소비하지만, 결국 미래의 대화에서 동일한 오류가 다시 나타나는 것을 발견하곤 합니다. 도구가 그 수정을 기억하지 못한 이유는 그것을 기억하도록 진정으로 명령받은 적이 없기 때문입니다. 이는 현재의 시스템 설계가 모든 새로운 대화를 백지상태에서 시작하는 새로운 출발로 취급하여, 방금 전 배운 내용을 깨끗이 지워버리기 때문에 발생합니다. 이 논문은 텍le 생성 능력과, 시간이 흐름에 따라 학습하고 수정을 유지하려는 인간의 필요성 사이의 간극을 탐구합니다. 저자는 그 해결책이 새로운 유형의 소프트웨어나 더 똑똑한 알고리즘이 아니라, 복잡하고 예측 불가능한 기계를 매일 관리하는 일상적인 업무인 '시스템 엔지니어링' 분야에서 빌려온 운영 습관이라고 주장합니다.

30년 경력의 시스템 엔지니어인 저자는, 업계가 영구적인 메모리 파일이나 지침 가이드와 같이 AI가 무언가를 기억하게 만드는 도구에 지나치게 집중해 왔다고 관찰합니다. 그러나 논문은 이러한 도구를 갖추는 것만으로는 충분하지 않으며, 그것들을 다루는 사람들에게 엄격한 관리 프로세스가 없다면 소용이 없다고 제안합니다. 왜 수정이 이루어졌는지 기록하고, 그것이 제대로 작동하는지 확인하며, 더 이상 필요하지 않은 규칙을 결국 폐기하는 엄격한 방법이 없다면, 지침의 모음은 무질서하고 효과 없는 덩어리가 될 뿐입니다. 핵심적인 발견은 결여된 조각이 기술이 아니라 '규율(discipline)'이라는 점입니다. 저자는 AI를 마법 같은 신탁이 아니라, 세심한 구성과 지속적인 모니터링, 그리고 실수를 통해 배우는 명확한 루프가 필요한 하나의 장비로 취급하는 7단계 운영 모델을 제안합니다.

이 접근 방식은 단순하지만 강력한 깨달음에서 시작됩니다. 즉, AI의 지식은 실행 중에는 변경할 수 없는 컴퓨터 칩처럼 고정되어 있는 반면, 대화 자체는 전원을 끄면 사라지는 컴퓨터의 메모리처럼 일시적이라는 사실입니다. 인간이 채팅 중에 AI를 수정할 때, 그 수정은 해당 세션에만 유효합니다. 세션이 종료되면 그 수정은 사라집니다. AI를 진정으로 개선하기 위해서는, 수정 사항을 시스템이 시작될 때마다 로드되는 영구적인 구성 파일에 기록해야 합니다. 논문은 이를 "쓰기-백 경로(write-back path)"라고 부릅니다. 이것은 작업자에게 문제를 한 번 고치라고 말하는 것과, 모든 작업자가 미래의 모든 교대 근무에서 동일한 실수를 피할 수 있도록 공식 매뉴얼을 업데이트하는 것의 차이입니다.

제안된 시스템은 이 과정을 관리하기 위한 7가지 가이드 원칙에 의존합니다. 첫째, 모든 의미 있는 수정은 영구적인 기록으로 저장되어야 합니다. 그렇지 않으면 그것은 손실됩니다. 둘째, 이러한 규칙들은 계층별로 조직되어야 하며, 일반적인 규칙은 특정 프로젝트를 위한 구체적인 규칙과 분리되어 혼란과 중복을 방지해야 합니다. 셋째, AI는 본질적으로 예측 불가능하며 단일한 보장된 답이 아닌 다양한 범위의 답변을 생성하므로, 목표는 전체 결과의 범위를 관리하는 것이며, 특히 그 범위의 가장자리에서 발생하는 드물지만 위험한 실수에 집중해야 합니다. 넷ce, 인간 전문가는 기계가 스스로 감지할 수 없는 오류를 잡아내고, 그 수정 사항이 영구적인 시스템에 다시 기록되도록 보장하는 최종 안전 점검 역할을 수행합니다.

남은 원칙들은 측정과 유지 관리에 초점을 맞춥ut습니다. 저자는 단순히 도구가 얼마나 많이 사용되었는지를 세는 것은 품질보다는 활동을 보상하기 때문에 나쁜 성공 척도라고 경고합니다. 대신, 팀은 특정 유형의 오류가 시간이 지남에 따라 실제로 멈추는지 추적해야 합니다. 또한, 규칙 목록을 정기적으로 검토하여 더 이상 유용하지 않은 것을 제거함으로써 시스템이 오래된 지침들로 인해 무거워지는 것을 방지해야 합니다. 마지막으로, 팀은 항상 자신들이 실제 목표를 겨냥하고 있는지 확인해야 합니다. 만약 과정이 그저 무작위한 노이즈에 불과하다면, 아무리 많은 규율도 개선을 만들어낼 수 없습니다.

이것이 실제로 어떻게 작동하는지 보여주기 위해, 저자는 세 가지 실무 사례를 공유합니다. 한 사례에서 AI는 컴퓨터 프로그램의 속도를 높이기 위한 기술적 방법을 제안했으나, 그 방법이 특정 상황에서 실패하여 오히려 원래 막으려 했던 속도 저하를 일으켰습니다. 이 새로운 규율을 적용함으로써, 엔지니어는 단순히 코드를 고친 것이 아니라, AI가 특정 조건을 확인하지 않고는 다시는 그 방법을 선택하지 못하도록 하는 영구적인 규칙을 만들었습니다. 또 다른 사례에서는 무단 접근을 차단하기 위한 보안 규칙이 너무 형편없이 작성되어 오히려 모든 사람을 허용하는 결과를 초క 낳았습니다. 시스템은 해당 규칙이 막으려던 해악을 초래할 수 있는지에 대한 구체적인 질문을 던짐으로써 이를 포착했습니다. 세 번째 사례는 시스템이 역방향으로 작동하는 모습을 보여주었습니다. AI가 인간의 작업을 검토하던 중 인간 자신의 사고 과정에 있는 틈을 발견했고, 이는 인간의 프레임워크를 개선하는 수정으로 이어졌습니다. 이는 파트너십이 양방향으로 작동하며, 인간과 기계가 서로를 교정한다는 것을 입증했습니다.

논문은 인공지능의 기술은 새롭지만, 이를 안전하게 운영하는 데 필요한 규율은 새롭지 않다고 결론짓습니다. 설명된 방법들은 수십 년 동안 복잡한 산업용 기계와 트레이딩 시스템을 관리하기 위해 사용되어 온 것들과 같습니다. 저자는 현재 업계가 AI가 대화 사이에 모든 것을 잊어버리는 설계를 향해 가고 있다고 주장하는데, 이는 기계에게는 효율적이지만 사용자에게는 위험합니다. 해결책은 기계 주변에 인간의 거버넌스 층을 구축하여, 학습된 모든 교훈이 보존되고, 테스트되며, 시간이 흐름에 따라 시스템의 성능을 강화하는 데 사용되도록 보장하는 것입니다. 저자는 이 제안이 과학적 증명이 아닌 경험과 논리에 기반한 것임을 인정하며, 이러한 아이디어들을 실제 데이터로 테스트하기 위한 향후 연구 계획을 개략적으로 설명합니다. 그때까지 메시지는 명확합니다. 이 강력한 도구들을 최대한 활용하려면, 우리는 그것들을 마법이 아니라, 꾸준한 손길과 명확한 규칙이 필요한 기계로 대해야 한다는 것입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →