人工智能(AI)正在影响我们开展和分享科学研究的方式,使机器能够执行传统上需要人类智能才能完成的任务。然而,与任何新技术一样,在使用这些工具时,我们必须考虑相关的伦理问题。
AI 擅长分析复杂数据集,并识别人工审阅信息时可能难以发现的模式。通过引入机器学习算法,AI 软件可以从这些数据中学习,并经过训练,根据这些模式作出预测。
与此同时,自然语言处理软件使研究人员能够快速浏览大量论文以了解新课题,此外还有其他工具可用于生成和审查文字与视觉内容。
在探索这些创新技术的同时,我们也必须考虑如何以及何时使用它们,以维护科学出版的诚信。为了坚守伦理并持续建立对科学研究的信任,学术界必须继续展现透明度、问责精神和可信度。
防范错误信息
人工智能聊天机器人 ChatGPT 于 2022 年推出,两个月后用户数便达到 1 亿[1]。在探索其功能时,有些人用它来娱乐,比如写诗或寻求建议,另一些人则用它获取有用的见解并生成内容。例如,在科学界,有些人使用该工具来帮助生成研究论文的部分内容,使其实际上充当了 AI 论文写作工具。例如,在科学界,有些人使用该工具来帮助生成研究论文的部分内容。
ChatGPT、AI 论文写作工具与科学出版伦理
AI 虽具创新性,但也有其局限,因为这些系统的质量取决于训练所用的数据[2]:数据中的任何偏差或不准确之处都会体现在生成的内容中。例如,《Men’s Health》[3]刊发的首篇 AI 生成文章因包含大量不准确和虚假内容而受到调查,尽管其内容看起来附有学术风格的引用。对此,许多出版商(例如《Nature》)调整了编辑政策,明确限制使用 ChatGPT 等大语言模型(LLM)为科学稿件生成内容,凸显了对出版伦理问题的关注。

防范滥用与出版伦理
AI 在性能和透明度方面的局限意味着人类不能完全依赖这项技术。研究人员、编辑和出版机构有责任核实事实,确保遵守出版伦理。
论文工厂(即生产伪造内容的组织)的出现,是 AI 滥用的一个常见例子。虽然目前流通的论文工厂文章所占的确切比例尚不清楚,但出版商普遍深感担忧:这是一种难以发现的现象,会损害科学出版物的可信度。
然而,审查科学论文中与论文工厂相关的疑似图像篡改可能非常耗时,且结果并不总是准确,尤其是因为一篇论文可能包含数百幅子图。
AI 可以将这一过程自动化,在发表前检测出滥用或无意重复的情况。例如,图像完整性审校软件利用计算机视觉和 AI,在几分钟内扫描稿件并比对图像,标记任何潜在问题。随后,负责图像取证的编辑可以借助该工具进一步调查,查找剪切粘贴、删除或其他形式的篡改。
结论:科学出版中 AI 论文写作工具的伦理考量
AI 具备多种能力,并将不断改进,但我们也不能指望这项技术自行遵循伦理行事。随着科学界对 AI 及其应用的了解不断加深,诚信专家应携手为其在内容生成中的使用制定明确的指南和标准,尤其是针对 AI 论文写作工具的使用者。然而,尽管有这些努力,论文工厂仍将继续存在。因此,出版商应持续投入并采用当时可用的、适宜的技术解决方案,在发表前审查稿件。当然,与此同时还应广泛努力开发更多方法,遏制论文工厂的蔓延。
小贴士
在打算使用 AI 工具时,请参考编辑、出版商和伦理委员会发布的指南,了解如何在使用这些工具获益的同时维护诚信。出版商也应探索 Proofig AI 等 AI 工具如何帮助他们更有效地检测论文工厂生产的内容。
参考文献
[1] ChatGPT reaches 100 million users two months after launch
[2] Data centric AI models are only as good as their data pipeline
[3] Magazine publishes serious errors in first AI-generated health article
[4] Tools such as ChatGPT threaten transparent science; here are our ground rules for their use