More than half of recent astronomy papers are written with language-model assistance
20만 편 이상의 천문학 논문에 대한 계층적 베이즈 분석 결과, 최근의 astro-ph 원고 중 절반 이상이 언어 모델의 도움을 받은 언어적 흔적을 보이고 있는 반면, 그러한 사용을 명시적으로 공개한 논문은 1% 미만인 것으로 나타났다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
데이터가 넘쳐나는 고요한 천문학의 세계에서, 과학자들은 멀리 떨어진 별과 은하로부터 오는 빛을 우주에 관한 이야기로 번역하며 하루를 보냅니다. 수십 년 동안 이러한 발견들의 기록 언어는 화려함을 배제하고 오로지 정밀함에만 집중한 엄격하고 기술적인 방언이었습니다. 하지만 2022년 말, 새로운 도구가 등장했습니다. 유창하고 인간 같은 텍end을 작성할 수 있는 고급 컴퓨터 프로그램입니다. 언어 모델로 알려진 이 도구들은 연구자들이 논문을 초안하거나, 문법을 점검하고, 복잡한 아이디어를 정리하는 데 도움을 주는 용도로 빠르게 인기를 얻었습니다. 곧 제기된 질문은 이 도구들이 사용되고 있는지 여부가 아니라, 그 영향력이 얼마나 광범위해졌는가 하는 것이었습니다. 만약 컴퓨터가 과학 논문을 쓰는 것을 도왔다면, 그 텍스트는 달라 보일 것인가? 인간 저자는 거의 선택하지 않지만 기계가 선호하는 특정한 단어 세트와 같은 미묘한 지문, 즉 특유의 흔적을 남길 것인가?
오하이오 주립대학교와 막스 플랑크 천문학 연구소의 연구팀은 실제 문헌 속의 단어들을 살펴봄으로써 그 답을 찾고자 했습니다. 그들은 2015년부터 2026년 중반 사이에 제출된 20만 편 이상의 천문학 논문 전문을 분석했습니다. 그들의 목표는 얼마나 많은 문서가 컴퓨터의 도움을 받은 흔적을 보이는지 계산하는 것이었습니다. 그들은 "delve(깊이 파고들다)", "underscore(강조하다)", "intricate(복잡한)", "pivotal(중추적인)"과 같이 기계 생성 텍스트에서 흔히 나타나는 특정 단어 목록에 집중했습니다. 이것들은 "적색편이"나 "초신성" 같은 기술 용어가 아니라, 문장에 특정한 리듬을 더하는 스타일적인 선택들입니다. 이러한 컴퓨터 도구들이 부상하기 전에는 천문학자들이 이 단어들을 드물게 사용했습니다. 연구자들은 최근 논문들에서 이러한 단어들이 갑자기 나타나는 것이 논문을 작성할 때 도움을 받았음을 의미하는지 알고 싶었습니다.
명확한 그림을 얻기 위해, 연구팀은 단순히 단어를 세는 것에 그치지 않고 신호와 소음을 분리하기 위한 정교한 통계 모델을 구축했습니다. 그들은 언어가 시간이 흐름에 따라 변한다는 점과, 어떤 단어들은 컴퓨터 사용 외의 다른 이유로 인기를 얻을 수도 있다는 점을 알고 있었습니다. 이를 고려하기 위해, 그들은 도구들이 널리 보급되기 전인 2020년 이전에 작성된 논문들에서 이 단어들이 어떻게 사용되었는지 살펴보았습니다. 이는 인간 천문학자가 자연스럽게 이 단어들을 얼마나 자주 사용하는지에 대한 기준점(baseline)을 제공했습니다. 그런 다음 이 기준점을 2022년 이후에 작성된 논문들과 비교했습니다. 결정적으로, 그들은 저자들이 언어 모델 사용을 명시적으로 인정한 소수의 논문들도 살펴보았습니다. 이 인정된 논문들은 '컴퓨터의 도움을 받은' 논문이 데이터상에서 실제로 어떤 모습인지를 이해하도록 돕는 알려진 참조점, 즉 보정점으로 역할을 했습니다.
결과는 놀라웠습니다. 2025년까지 연구자들은 모든 새로운 천문학 논문의 절반 이상이 언어 모델의 도움을 받은 흔적을 담고 있다고 추정했습니다. 구체적으로, 그들은 54%의 논문이 컴퓨터의 도움을 받은 것과 일치하는 어휘 패턴을 보인다고 계산했으며, 가장 보수적인 가정하에서도 이 수치는 36%를 안정적으로 상회했습니다. 이 수치는 빠르게 상승하고 있습니다. 2024년에는 약 20%였으나, 2026년 상반기에는 거의 87%까지 치솟았습니다. 이는 이러한 도구의 사용이 드문 실험에서 벗어나 대다수 천문학자의 글쓰기 과정에서 표준적인 부분이 되었음을 시사합니다.
하지만 이야기는 단순한 논문 수의 집계보다 더 복잡합니다. 연구자들은 컴퓨터의 "지문"이 점점 더 알아보기 어려워지고 있다는 것을 발견했습니다. 2023년 초에는 이러한 도구를 사용한 논문들이 특정 표식 단어들을 매우 강하게 과잉 사용했습니다(인간이 쓴 논문보다 약 3.5배 더 많이). 2026년에는 그 과잉 정도가 기준치의 1.5배로 떨어졌습니다. 이는 저자들이 적응하기 시작했기 때문에 발생한 현상입니다. "delve"와 같은 특정 단어들이 컴퓨터 사용의 징후로 유명해지자, 필자들은 이 단어들을 그렇게 많이 사용하지 않거나 편집하여 제거함으로써 컴퓨터의 손길을 덜 드러내게 만든 것입니다. 도구들은 여전히 사용되고 있지만, 더욱 미묘해지며 인간의 글쓰기 스타일 속에 자연스럽게 스며들고 있습니다.
아마도 가장 시사하는 바가 큰 발견은 실제로 일어나고 있는 일과 말해지고 있는 일 사이의 간극일 것입니다. 연구자들이 2025년 논문의 54%가 도움을 받았다고 추정하는 반면, 그러한 논문 중 컴퓨터 사용을 공식적으로 선언한 논문은 0.81%에 불 불과했습니다. 즉, 저자가 도구 사용을 인정한 논문 한 편당, 동일한 언어적 흔적을 보이면서도 아무런 언급을 하지 않은 논문이 약 66편 존재했습니다. 연구자들은 자신들의 탐지 방법을 면밀히 점검했으며, 선언을 놓친 경우가 많지 않다는 것을 확인했습니다. 즉, 침묵은 실재하는 것으로 보입니다. 목소리를 낸 대부분의 저자들은 도구를 문법, 명확성 또는 언어 편집을 위해 사용했다고 말했는데, 이는 많은 학술지가 이미 허용하고 있는 작업들입니다. 이러한 공표의 결여는 부정행위를 숨기려는 의도라기보다는, 과학계가 이러한 도구의 사용이 수용 가능한지에 대해 아직 합의를 이루지 못했기에 발생하는 낙인을 피하려는 욕구에서 기인한 것으로 보입니다.
이 연구는 과학적 글쓰기의 풍경이 근본적으로 변화했다고 결결론짓습니다. 도구들은 더 이상 신기한 물건이 아닙니다. 그것들은 천문학 논문이 생산되는 방식의 지배적인 힘입니다. 연구자들은 이러한 변화가 반드시 청렴성의 실패를 의미하는 것이 아니라, 공동체가 아직 따라잡지 못한 관행의 변화라고 언급합니다. 이러한 도구들의 언어적 흔적이 계속해서 희미해지고 탐지하기 어려워짐에 따라, 그 영향을 측정할 수 있는 창은 닫히고 있습니다. 저자들은 가장 시급한 과제가 도구를 금지하거나 사라져가는 신호를 쫓는 것이 아니라, 명확한 공개 규범을 확립하는 것이라고 제안합니다. 만약 저자들이 이러한 보조 도구를 사용했을 때 이를 단순히 밝힌다면, 학계는 현재 무시되고 있는 관행을 투명하게 이해되는 방식으로 전환하여 혼란 없이 앞으로 나아갈 수 있을 것입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.