Computer-generated content and the AI/ML retraction record, 2018– 2026: a characterization study
2018年から2026年までの13,502件のAI/ML関連の撤回記録に関するこの特性評価研究は、コンピュータ生成コンテンツが撤回の最大の単一の推定原因であり、事例の34.8%を占め、主に2021年から2023年の間に発表された論文に影響を与えていることを明らかにしている。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
科学出版の世界を、巨大で賑やかな図書館だと想像してみてください。長年、司書たち(編集者や査読者)は、本が棚に並ぶ前に、その物語が真実であるか、そして著者が自らの手でその仕事を成し遂げたものかどうかを確認してきました。
この論文は、2018年から2026年までの間の、その図書館における「返送品」の山に関する成績表のようなものです。具体的には、人工知能(AI)および機械学習のセクションに焦点を当てています。
著者であるアントン・ソコロフ(Anton Sokolov)が見出した物語を、分かりやすく説明します。
1. 新たな問題:「ゴーストライター」
2022年以前、このセクションの本が返送される場合、それは通常、著者が他人の物語を盗用した(盗作)、データを捏造した、あるいは「ペーパーミル(偽の論文を量産する工場)」に報酬を払って作成させたことが原因でした。
しかし、2022年から新しい事態が起こりました。大規模言語モデル(皆さんがチャットで使うようなAI)が、流暢で科学的に聞こえる文章を書くことに非常に長けてきたのです。突然、図書館には、これら「ゴーストライター」によって書かれた本の洪水が押し寄せ始めました。
この研究は、AIセクションから棚から取り下げられた(撤回された)13,502報の論文を調査しました。彼らは問いかけました。「なぜこれらの本は返送されたのか?」と。
2. 大発見
最も驚くべき発見は、これらのAI論文を取り下げる最大の理由が**「コンピュータ生成コンテンツ」**であったことです。
- 数字: 撤回されたAI論文100報につき、約35報が、テキストが(チャットボットのような)AIによって生成されたことを理由に取り下げられました。
- 比較: これは、「査読の妥当性への疑義」(22%)、「盗作」(18%)、あるいは「編集上のミス」(13%)よりも高い数値です。
パン屋に例えてみましょう。長年、パンが廃棄される主な理由は、焦げていたり古くなっていたりすることでした。しかし突然、そのパン屋では、生地そのものが、焼き方を知らないロボットによって作られたパンが大量に見つかり始めたのです。それが、パンを廃棄する最も一般的な理由となりました。
3. 「精度」フィルター(セーフティネット)
著者は、単に曖昧にカウントするのではなく、確信度の異なるレベルを持つ「セーフティネット」を作成しました。
- 高精度(High Precision): タイトルに明確に「AI」または「機械学習」と記されている論文(3,243報)。
- 広い網(Broad Net): 単に「コンピュータサイエンス」全般に関する論文(13,502報)。
「高精度」グループ(間違いなくAIに関するもの)のみを見た場合でも、**41.8%**がAI生成テキストを理由に撤回されていました。したがって、この問題は単なるラベル付けの緩さによる偶然ではなく、この特定の分野における現実的かつ支配的な問題なのです。
4. タイムライン:突然の波
この論文は、天気予報のように年次推移を追っています。
- 2018年–2021年: AI生成の論文が検知されることはほとんどありませんでした。
- 2022年: 波が始まりました。
- 2023年: 波がピークに達しました。これは、ある主要な出版社(Hindawi/Wiley)が大規模な清掃を行い、数千報の論文を一斉に取り下げたため、「津波」の年となりました。
- 2024年–2025年: 数値はピークからは減少しましたが、2022年以前よりも10倍高い水準を維持しています。
これらの問題のある論文の多くは、2021年から2023年の間に執筆・出版されました。これらは通常、出版後1年以内に迅速に検知されています。
5. 誰が関わっているのか?
この研究は、最も多くの撤回論文を出した出版社とジャーナルを挙げています。
- Hindawi(出版社)は最も多く、このリストにある全撤回論文の3分の1以上を占めています。
- しかし、著者は**「これは必ずしも『恥のリスト』ではない」**と警告しています。出版社が多くの撤回を出しているのは、彼らが「最悪の」出版社だからではなく、むしろ棚を積極的に清掃し、悪い論文を捕まえているからかもしれません。それは、返品カウンターがある店のようなものです。返品数が多いことは、その店が質の悪い製品を売っているからではなく、品質に対して非常に厳しいことを意味する場合があるのです。
6. この研究が「述べていないこと」
著者は、この報告が何を述べていないかについても明確にしています。
- 棚にまだ残っており、まだ検知されていないAI執筆の論文がどれくらいあるかは教えていません。
- AIの研究者が「悪い」人々であることを証明するものでもありません。
- AI研究が他の分野(生物学や物理学など)よりも失敗しやすいとは言っていません。比較するためのデータがまだ存在しないからです。
結論(ボトムライン)
この論文は「特性研究(characterization study)」です。それは、AI論文の「返送品」の箱をスナップショット撮影するようなものです。
主な教訓はシンプルです。AI生成テキストの時代が科学界に到来しており、その最初の大きな兆候は、テキスト自体が機械によって書かれたことによる、撤回数の劇的な急増であるということです。
研究は、科学がこの問題に対処するためには、これらの撤回に対して「これはAIによって書かれた」と明示する、機械判読可能な明確なラベルが必要であると結論付けています。これらの明確なラベルがなければ、問題を測定したり、適切に解決したりすることはできません。将来の解決策のための「基盤(substrate)」は、何が間違っていたのかという、誠実で明確な記録を持つことなのです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。