科技论文中生成式人工智能的使用边际
创始人
2024-05-08 17:40:51
0

原标题:科技论文中生成式人工智能的使用边际

2022年10月,美国OpenAI公司发布的大语言模型人工智能ChatGPT使得生成式人工智能技术达到一个新的发展阶段。 该平台结合了大量的数据、强大的计算能力和新颖的处理技术,能够对各种各样的输入生成类似人类的反应,且可自由访问, 已经吸引了数亿万次互动。

在学术研究和写作中,也有越来越多的作者开始使用生成式人工智能工具辅助科研,但是目前甚至有人使用ChatGPT等 大语言模型来撰写学术论文。如2023年9月,Physica Scripta(《物理写作》)刊登的一篇论文中出现了类似ChatGPT按钮上 短语Regenerate Response(“重新生成回复”),作者也证实使用了ChatGPT来帮助起草手稿,最终文章被出版商撤回。 这种生成式人工智能对于于科技期刊的破坏力是目前国内外学术期刊必须要面对的现实问题。

国际出版伦理委员会(Committee on Publication Ethics,COPE)对于认为生成式人工智能的反馈指示一种可能可信的答案, 而不一定是正确的内容。因此不负责任的使用生成式人工智能,且不检查事实和引用的真实性或准确性,可能会导致学术研究产生 不正确或误导性的信息。因而ChatGPT等生成式人工智能不符合作者标准,其产生的所有内容都应由人类作者进行监督和修改。 同样,世界医学编辑学会(World Association of Medical Editors,WAME)也在2023年1月发布了一系列针对生成式人工智能的建议:

(1)生成式人工智能语言工具不能作为作者;

(2)作者应明确生成式人工智能语言工具的使用,并提供有关如何使用的信息;

(3)作者应负责生成式人工智能语言工具在其论文中所做工作的责任(包括所呈现内容的准确性以及是否有抄袭),并负责其探索其 内容的恰当来源(包括人工智能语言工具生成的内容);

(4)编辑需要适当的工具来帮助检测生成式人工智能生成或修改的内容。

同样期刊界也对于生成式人工智能的使用保持谨慎的态度。JAMA(《美国医学会杂志》)认为除非是正式研究设计或方法的一部分, 否则不鼓励提交和发布人工智能、语言模型、机器学习或类似技术创建的内容,并且在没有明确描述创建的内容、模型或工具的名称、 版本和扩展号以及制造商的情况下,不允许提交和发布这些内容。作者必须对这些模型和工具生成的内容的完整性负责。

Nature(《自然》)也明确指出大型语言模型,如ChatGPT,目前不满足作者标准。值得注意的是,作者身份需要对作品的责任, 大型语言模型不能有效地完成这一内容。如在论文创作中使用过大型语言模型,则应适当记录在文章的方法部分(如果没有方法部分, 则在合适的部分替代)。Cell(《细胞》)和The Lancet(《柳叶刀》)也同样要求生成式人工智能不能以其替代作者完成文章的 关键部分,如解释数据或得出科学结论等,同时作者必须在文章中说明是否以及如何使用了人工智能工具。

随着对生成式人工智能认识的深入,部分期刊也开始调整其对生成式人工智能的态度。例如,Science(《科学》)从最初的禁止使用, 转变为只要在方法部分出现适当的披露,在研究中使用这些工具是可以接受的。但是大型语言模型(LLM)、聊天机器人和图像创建者等 生成式人工智能是不符合作者标准的,因此不能被列为作者。论文引用的资料来源,其作者或共同作者也不能有生成式人工智能。 使用生成式人工智能作为作为其研究的组成部分或辅助文章撰写,需要在cover letter和文章致谢部分标注。作者应在研究方法部分 披露生成式人工智能使用的详细信息:完整描述词、AI工具及其版本。作者应对文章的准确性负责,确保没有抄袭行为,还必须确保所有 资料都引用得当,并仔细审核以防止生成式人工智能引入偏倚。如果生成式人工智能使用不当,编辑可能会拒绝继续处理稿件。

未经编辑明确许可,生成式人工智能生成的图像和其他多媒体不得出现在《科学》杂志上。在某些情况下可能会有例外,例如文章为专门 讨论生成式人工智能和/或机器学习的图像和/或视频的。对于这些例外情况,编辑会针对具体情况进行评估,且要求作者在提交论文时进行 披露生成式人工智能生成的信息。

国内期刊也对生成式人工智能的使用设置了边际。《暨南学报》于2023年2月10日发布《关于使用人工智能写作工具的说明》, 称暂不接受任何大型语言模型工具单独或联合署名的文章,如果在论文创作中使用过相关工具,需单独提出,如有隐瞒使用情况, 将对文章直接退稿或撤稿处理。同样,在今年1月中华医学杂志社发布《关于在论文写作和评审过程中使用生成人工智能技术的有关规定》中, 只认可生成式人工智能用于研究过程的统计分析、语言润色、推荐统计图表类型、辅助制图以及参考文献格式的规范化检查。

在中国科学技术信息研究所发布《学术出版中AIGC使用边界指南》称,也建议研究人员使用生成式人工智能直接生成的稿件文字等 资料必须提供明确的披露和声明。同样《文献与数据学报》《中国科技期刊研究》《智库理论与实践》《图书情报工作》等国内期刊 均发表声明称,如果论文主要内容是利用生成式人工智能工具生成的,均以学术不端论处。

同样政府主管部门也对科研中使用生成式人工智能提出了规范。在2023年12月,国家自然科学基金委颁布的《科研诚信规范手册》中, 明确指出科研人员在填写申请书时应当杜绝使用生成式人工智能直接生成申报材料。但是在成果撰写与引文注释中是可以使用生成式人 工智能的。如使用生成式人工智能处理文字、数据、图像、音频、视频等,应在研究方法或附录等适当部分披露使用生成式人工智能的 方式和主要细节。使用生成式人工智能生成的内容,应明确标注并说明其生成过程;不应含有侵犯他人知识产权的内容;不得将其他作者 已标注为人工智能生成的内容作为原始文献引用,确需引用的应加以说明;不得将生成式人工智能列为成果共同完成人。评审专家使用生成式 人工智能评审的,应事先征得自然科学基金委的许可,在操作中防止泄露评议内容;一旦发生信息泄漏应及时告知自然科学基金委并采取必要 补救措施。

虽然生成式人工智能可能是研究人员的有用工具,但其对学术研究存在威胁,其生成的文章可能会引入虚假或剽窃的内容,而且同行评审 可能无法区分或检查生成式人工智能生成的内容。因此需要对生成式人工智能技术进行严格的监管和管理,确保其生成的内容能够符合期刊的 质量标准,遵循期刊的学术规范,同时也应充分利用生成式人工智能的优势,服务于我们的作者、专家、编辑和用户。

(网络信息检索资料整理)

相关内容

热门资讯

碳酸锂期货主力合约跳水跌近10... 9月11日,碳酸锂期货主力合约跳水跌近10%,现报129100元/吨。(广角观察)
沪深两市成交额突破1万亿,较上... 9月11日,数据显示,沪深两市成交额突破1万亿,较上一日此时放量近1200亿,预计全天成交金额约1....
光纤概念逆势走强,兆龙互连涨超... 9月11日,早盘光纤概念逆势走强,兆龙互连涨超10%、特发信息触及涨停,永鼎股份、长盈通、长飞光纤、...
8月份中国电商物流指数公布 9月11日,中国物流与采购联合会今天发布8月份中国电商物流指数。8月份中国电商物流指数为111.5点...
外交部副部长马朝旭会见联合国亚... 9月11日,外交部副部长马朝旭10日会见联合国亚太经社会执行秘书阿里沙赫巴纳,双方就2027年亚太经...
电力板块逆势拉升,江苏新能涨停 9月11日,早盘电力板块逆势拉升,江苏新能涨停,此前闽东电力3连板,杭州热电涨停,湖南发展、浙江新能...
长安汽车:部分网络账号诋毁公司... 9月11日,长安汽车不实信息举报中心发布严正声明称,近日,公司举办了2026天枢领航技术发布暨长安启...
Adobe第三财季营收、利润双... 9月11日,Adobe公布2026财年第三财季业绩,营收达67.6亿美元,同比增长13%,高于市场预...
加拿大总理召开闭门会议,或讨论... 9月11日,加拿大总理卡尼10日到11日召开为期两天的闭门内阁会议。有消息称,此次内阁会议可能将讨论...
港股开盘:恒指跌0.95%,科... 9月11日,港股开盘,恒生指数跌0.95%,恒生科技指数跌1.36%。大型科网股全线下跌,阿里巴巴跌...