More than half of recent astronomy papers are written with language-model assistance
20万本以上の天文学論文に対する階層的ベイズ分析によれば、近年のastro-ph原稿の半数以上に言語モデルによる支援の言語学的痕跡が見られるが、その数値は、そのような使用を明示的に開示している論文の1%未満という割合を大幅に上回っている。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
天文学という、データが密集した静かな世界において、科学者たちは遠く離れた星や銀河からの光を、宇宙についての物語へと翻訳することに日々を費やしている。数十年にわたり、こうした発見の記述言語は、装飾を削ぎ落とし、精密さに完全に焦点を当てた、厳格でテクニカルな方言であった。しかし、2022年後半、新しいツールが登場した。流暢で人間らしいテキストを書くことができる高度なコンピュータプログラムである。言語モデルとして知られるこれらのツールは、論文の草稿作成、文法のチェック、複雑なアイデアの整理を支援するものとして、瞬く間に普及した。そこで直ちに生じた疑問は、これらのツールが使われているかどうかではなく、その影響がいかに広範になったかということであった。もしコンピュータが科学論文の執筆を助けたとしたら、そのテキストは異なるものになるのだろうか。それは、人間の書き手はめったに選ばないが、機械が好む特定の単語のセットといった、微かな「指紋」を帯びることになるのだろうか。
オハイオ州立大学とマックス・プランク天文学研究所の研究チームは、文献内の実際の言葉を調べることで、その答えを見つけ出そうとした。彼らは、2015年から2026年中盤までに提出された20万本以上の天文学論文の全文を分析した。彼らの目的は、これらの文書のうち、コンピュータによる支援の兆候を示すものがどれくらいあるかを数えることだった。彼らは、「掘り下げる(delve)」、「強調する(underscore)」、「複雑な(intricate)」、「極めて重要な(pivotal)」といった、機械生成テキストによく見られるようになった特定の単語のリストに注目した。これらは「赤方偏移(redshift)」や「超新星(supernova)」のような専門用語ではなく、文章に一定のリズムを加える文体的な選択肢である。これらのコンピュータツールの台頭以前、天文学者はこれらの言葉を控えめに使用していた。研究者たちは、最近の論文におけるこれらの言葉の突然の出現が、論文がコンピュータの助けを借りて書かれていることを意味しているのかを知りたかったのである。
明確な全体像を得るために、チームは単に単語を数えただけではなく、信号(シグナル)をノイズから分離するための洗練された統計モデルを構築した。彼らは、言語は時間の経過とともに変化すること、そして一部の単語はコンピュータの使用以外の理由で人気が出る可能性があることを理解していた。これを考慮するために、彼らはツールが広く利用される前である2020年より前に書かれた論文における、これらの言葉の使用状況を調査した。これにより、人間の天文学者が自然にこれらの言葉をどの程度使用するかという基準(ベースライン)が得られた。次に、彼らはこのベースラインを、2022年以降に書かれた論文と比較した。極めて重要な点として、彼らは著者が言語モデルの使用を明示的に認めている少数の論文についても調査した。これらの公表された論文は、キャリブレーション・ポイント(校正点)、すなわち、チームが「コンピュータ支援を受けた」論文がデータ上で実際にどのようなものかを理解するための既知の参照点として機能した。
結果は驚くべきものであった。2025年までに、研究者たちは、すべての新しい天文学論文の半分以上が言語モデルによる支援の痕跡を帯びていると推定した。具体的には、54パーセントの論文がコンピュータの助けと一致する語彙パターンを示しており、最も保守的な仮定の下でも、その数値は36パーセントを余裕を持って上回っていた。この数字は急速に上昇している。2024年にはその数値は約20パーセントであったが、2026年上半期までには87パーセント近くにまで達していた。これは、これらのツールの使用が、稀な実験から、大多数の天文学者にとって標準的な執筆プロセスへと移行したことを示唆している。
しかし、物語は単純な論文数のカウントよりも複雑である。研究者たちは、コンピュータの「指紋」が捉えにくくなっていることを見出した。2023年の初期段階では、これらのツールを使用した論文は、特定のマーカーとなる単語が、人間が書いた論文よりも約3.5倍多く含まれていた。2026年までに、その過剰分はベースラインのわずか1.5倍に減少した。これは、著者が適応し始めたために起こったことである。「掘り下げる(delve)」のような特定の単語がコンピュータ使用の兆候として有名になると、書き手はそれらを多用しなくなったり、あるいは削除したりして、コンピュータの手跡をより目立たなくさせたのである。ツールは依然として使われているが、それらはより巧妙になり、人間の執筆スタイルにより自然に溶け込んでいる。
おそらく最も示唆に富む発見は、起きていることと、語られていることの間のギャップである。研究者が2025年の論文の54パーセントが支援を受けていると推定している一方で、コンピュータの使用を正式に宣言している論文は、わずか0.81パーセントであった。言い換えれば、著者がツールの使用を認めた論文1本につき、同じ言語的痕跡を示しながら何も語らなかった論文が約66本存在した。研究者たちは検出方法を注意深く検証し、宣言を見逃していることはほとんどないと判断した。この沈黙は、意図的なものである。ほとんどの著者は、ツールを文法、明快さ、あるいは言語編集のために使用したと述べており、これらは多くのジャーナルがすでに許可している作業である。表明の欠如は、不正行為を隠そうとする試みからではなく、科学コミュニティがこれらのツールの使用が許容されるかどうかについてまだ合意に至っていないことから生じる、スティグマ(負の烙印)を避けたいという欲求に起因しているようだ。
研究は、科学的な執筆の風景が根本的に変化したと結論づけている。これらのツールはもはや珍しいものではなく、天文学の論文が作成される際の支配的な力となっている。研究者たちは、この変化は必ずしも誠実さの欠如ではなく、コミュニティがまだ追いついていない慣習の変化であると指摘している。これらのツールの言語的な痕跡が薄れ、検出が困難になり続ける中で、その影響を測定できる期間は閉まりつつある。著者たちは、最も緊急のステップは、ツールを禁止したり消えゆく信号を追いかけたりすることではなく、開示に関する明確な規範を確立することであると示唆している。もし著者がこれらの補助手段を使用したことを単に公表していれば、この分野は、現在無視されている慣習を、公然と理解されたものへと変え、混乱することなく前進することができるだろう。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。