8月,美国西北大学社会系统领域专家在《美国国家科学院院刊》发文称,科学欺诈已形成涵盖论文工厂、出版商、编辑的复杂产业链。更令人担忧的是,随着生成式人工智能(AI)技术的兴起,AI代写论文的现象正迅速蔓延,这进一步加剧了学术不端问题。这两大趋势交织在一起,给科学出版业带来了前所未有的挑战。
科学欺诈形成庞大产业链
此次调查重点放在了《公共科学图书馆·综合》期刊,因为该期刊可让团队方便地获取大量元数据,以及处理每年发表的数千份论文的编辑姓名。通过分析被撤回或受批评的论文,团队发现33名编辑存在异常,他们处理的论文中被撤回或受到批评的比例异常之高。其中一名编辑处理的79篇论文中,有49篇被撤回,比例高达62%。

该团队还发现,这些编辑以令人可疑的高速度对某些作者的论文进行处理。这些作者往往是《公共科学图书馆·综合》自己的编辑,他们经常处理彼此的论文,其中一些存在包庇问题。
这种现象并非个例。美国约翰威出版社收购的英国Hindawi出版社旗下10种期刊曾被发现存在类似问题,最终导致这些期刊停刊。更令人震惊的是,专家们发现了有组织地批量发表可疑论文的行为。通过分析外文论文同行评审平台——PubPeer上标记的2000多篇含有重复图像的论文,他们识别出多个论文集群,这些论文往往在同一时间段发表在有限的几种期刊上。
印度钦奈的学术研究与发展协会(ARDA)就是这个产业链中的一个典型角色。该机构提供从论文写作到期刊发表的一站式服务,收费在250至500美元之间。ARDA会根据期刊的信誉变化调整其合作列表,剔除那些因可疑行为被文献计量数据库除名的期刊,以招揽更多作者发表论文。
这类有组织的学术欺诈增速惊人。研究发现,2016年至2020年间,疑似论文工厂产出的论文数量每1.5年就翻一番,增速是整体科学文献增长的10倍。尽管这类论文在总量中占比小,但增长趋势令人担忧。

AI威胁科学研究准确性
就在学术机构努力应对传统学术欺诈的同时,生成式AI技术的兴起又带来了新的挑战。美国斯坦福大学研究团队8月4日在《自然·人类行为》上发表的研究显示,自2022年ChatGPT问世以来,科学论文中AI生成内容的比例持续上升。