aiminute. ← AIニュース一覧
研究 AI Minute Newsroom 2026-08-24

昨年末の時点で、生物医学論文の10本に9本が言語モデルの指紋を帯びていた

昨年末の時点で、生物医学論文の10本に9本が言語モデルの指紋を帯びていた

Lena Holzwarth、Rita González-Márquez、Dmitry Kobakの3氏が8月11日にarXivへ投稿したプレプリントは、2025年12月末までに公開されたPubMed Centralのオープンアクセス生物医学論文のうち89%で、大規模言語モデルに結びつく語彙が過剰に現れていると推定した。手法は、信頼性に欠けるAI文章検出器をあえて使わない。代わりに、チャットボットが広く使えるようになったあと、特定の語の出現頻度がコーパス全体でどう動いたかを追い、その超過分を測る。従来の試みより感度が高く、数値が過去の推定を上回るのはそのためだ。示唆に富むのは章ごとの内訳である。考察が68%、要旨が67%、序論が59%、結果が46%、方法が32%。論文が主張を組み立てる箇所ほど濃く、実際に何をしたかを報告する箇所ほど薄い。ネイチャーは8月21日にこのプレプリントを報じた。査読は経ておらず、この指標は下書きだけでなく編集や推敲も拾うため、どちらが起きたのかは区別できない。

なぜ重要か科学の文章におけるAIは周辺的な問題だ、と誰かが言ったときに差し出すべき数字がこれだ。この尺度では周辺どころか既定である。ただし、どこまで警戒すべきかを決める前に章別の内訳を読んでほしい。方法の節、つまり他の研究室が実験を再現するために必要な部分は影響が最も小さく、結果の意味を論じる考察の節が最も大きい。母語で書かない研究者が多いことを踏まえ、彼らがこれらの道具を発見の捏造ではなく主張の言い回しに使っているとすれば、おおむねこの形になる。それでも名指しに値する変化だ。学術誌は現在、著者にAI利用の申告を求めているが、10本に9本に痕跡があるなら、その申告欄はほとんど何も測っていない。
#医療AI#科学・研究

✓ 検証済み · 3ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

OpenAIが符号の誤りで数学論文3本を撤回した。
2026-10-08
AIの数学が量子計算機より早く暗号を破るとブテリンが言う。
2026-10-08
最も安いものを求めた富裕層にAI代理人は高い案を勧めた。
2026-10-08
OpenAIが機械検証した証明は、発表した証明と別物だった。
2026-10-08
エヌビディアは一回の学習でモデルの1%しか変わらないと確かめた。
2026-10-07