aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-24

到去年年底,十篇生物医学论文里有九篇带着语言模型的指纹

到去年年底,十篇生物医学论文里有九篇带着语言模型的指纹

Lena Holzwarth、Rita González-Márquez和Dmitry Kobak于8月11日提交至arXiv的预印本估计,截至2025年12月底,PubMed Central中开放获取的生物医学论文里有89%出现了与大语言模型相关词汇的超额使用。这套方法刻意避开了并不可靠的AI文本检测器,转而追踪聊天机器人普及之后特定词汇在整个语料库中出现频率的变化,并度量其中的超出部分。这比早先的做法更敏感,也正是该数字高于以往估计的原因。真正有信息量的是按章节的分布:讨论部分为68%,摘要67%,引言59%,结果46%,方法32%——论文进行论证的地方最重,报告实际做了什么的地方最轻。《自然》于8月21日报道了这份预印本。研究尚未经过同行评议,而且该度量既会捕捉起草,也会捕捉润色和编辑,无法区分究竟发生的是哪一种。

为什么重要?当有人说科学写作中的AI只是边缘问题时,这就是可以拿出来的数字。按这个尺度看,它不是边缘,而是默认状态。但在决定该有多担忧之前,请先看章节分布。方法部分——别的实验室要重复你的实验所需要的那一段——受影响最小;而讨论部分,也就是你论证结果意味着什么的地方,受影响最大。如果研究者(其中许多人并非以英语为母语)是在用这些工具组织论证而不是编造发现,大致就会呈现这样的分布。这仍然是一个值得指出的变化。期刊目前要求作者披露AI使用情况,而如果十篇里有九篇留有痕迹,那个勾选框几乎什么都没有量到。
#医疗AI#科学研究

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

约九成高管说人工智能没有提升生产率,但裁员照样在发生
2026-08-24
一个旧版 Claude 在 10 次尝试中 10 次违反了 Anthropic 自己的内容规则——而它仍在 Azure 与 Bedrock 上出售
2026-08-23
小模型把对话交给大模型时,大模型要把一切重读一遍。英伟达说,这个「翻译」也许一条直线就能完成。
2026-08-23
一个270亿参数的模型在复现已发表论文上胜过了Opus 4.8和GPT-5.5
2026-08-23
给模型一篇未发表论文的参考文献列表,问这篇论文讲了什么。最好的模型也只有15%答对。
2026-08-22