
TL;DR
大型语言模型反复生成相同的虚构人名,这些‘幽灵作者’正在污染学术数据库和出版物,但它们的名字反而成了识别 AI 生成内容的线索。
一份新研究发现了学术出版界的一桩怪事:一些论文和书籍的作者署着 Elena Vasquez、Marcus Chen 这类名字,但这些人根本不存在。它们是 AI 模型在编造专家时反复吐出的虚构人物,被研究者称为“幽灵夫妻”。
幽灵作者从哪来
大语言模型有个怪毛病:编人时总爱重复用同一批名字。给 ChatGPT 要一个软件开发者,它常给出 Marcus Chen;让 Claude 写小说,它可能冒出 Elena Vasquez。这些名字被当成真专家,混进了学术论文、书籍,甚至企业官网。
此前有家叫 Research Gold 的公司号称提供人类医学研究,实际全是 AI 生成,而它的“首席方法学家”正是 Elena Vasquez。文章曝光后,这家公司悄悄删掉了这个名字。
学术记录被悄悄“闹鬼”
研究者发现,在学术平台 Zenodo 上,AI 生成的论文能轻易获得正式的 DOI(一串识别论文的字符),1,655 篇幽灵论文还伪造了期刊和日期,而且被 Google Scholar 等检索工具收录。
好消息是:不同模型偏爱不同名字,比如 Elena Vasquez 常见于 Claude Sonnet 4 生成的内容。所以这些名字能反过来帮人识别 AI 垃圾。但随着 AI 内容泛滥、重新被模型吞回去,这套线索恐怕很快也会失效。
从全球优质信息源中筛选,几分钟了解当天最值得关注的观点。