点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:让AI自动审稿 一共分三步
首页> 科普频道> 科普头条 > 正文

让AI自动审稿 一共分三步

来源:《中国科学报》2021-07-27 09:39

调查问题加载中,请稍候。
若长时间无响应,请刷新本页面

  记者 郑金武

  谈及研究AI自动审稿系统的初衷,卡内基·梅隆大学博士后刘鹏飞说,“在不同的时代背景下,都会有一些新的、不同的发展需求;一个人如果能感受到它并且把握住,那么就会成为这个时代所在领域的弄潮儿,或者成为所在领域的领先者。”

  科学研究的快速发展,使得同行评议的科学出版物呈现指数级增长。以机器学习和计算神经科学国际会议——神经信息处理系统大会(NeurIPS)为例,2017年其投稿量有3000余篇,至2020年,上升到了1万余篇。繁重的审稿工作给现有的审稿机制带来了巨大的挑战。

  “所以我们思考自动审稿的可能性,即AI能否帮助我们从繁重的审稿工作中解放出来?”刘鹏飞于是和卡内基·梅隆大学硕士生袁玮哲、助理教授格雷厄姆·纽比格合作,着手研究AI自动审稿系统“ReviewAdvisor”。在日前的智源社区青源LIVE活动上,刘鹏飞与袁玮哲在线分享了研究该系统的历程。

  解构

  之前,也有人尝试做“自动审稿”任务,但这些工作几乎都是把AI生成的评审意见和人写的意见混在一起,让大家看看能不能区分。这些工作很难评价AI生成的评审意见是否合理以及高质量。

  可以说,AI自动审稿这项工作的第一个贡献,就是提出了一些评价指标,能够从多角度刻画“评审意见”的质量。

  “对于我们来说,首先需要回答的一个问题是,什么才是一个好的评审意见。”袁玮哲认为,否则自动审稿系统就无从谈起,“因为就算设计出了系统,没有好的指标去衡量生成的评审意见的质量,也很难去提升系统”。

  为此,3人查阅了很多顶级会议的“论文评审指南”,总结出了一个好的评审意见应该具备的特征,主要有5个方面:判断性、全面性、合理性、准确性、拟人性。例如,判断性是指评审意见对一篇论文质量好坏的评判,与这篇论文最后是否被接收之间的关联性。

  同时,“我们也希望系统生成的评审意见,与人写的评审意见相比,在书写结构、语义逻辑等方面,都应该是比较类似的。”袁玮哲说。

  建模

  评价指标的挑战解除后,随之而来的是数据集的挑战。“同行评审数据非常少,而且评审数据都是非常私人的,不愿意公开。”袁玮哲认为,之所以此前很难做“自动评审”这样的研究,数据少且不公开是重要原因。

  而后出现的“公开评审”平台,让人们有机会从中获得一些评审意见数据。但因为前几年的投稿量非常少,“公开评审”平台上只有几百或者上千条数据,这样的数据量也很难进行一些自动审稿模型的训练。但近年来恰逢AI研究非常火热,投稿量基本上是年年翻倍,研究人员能够从公开评审平台上收集到足够多的数据,保证模型训练。

  于是,3人用网络爬虫工具,获取了2017年~2020年的ICLR(国际学习表征会议)和2016年~2019年的NeurIPS会议的公开评审数据,一共收集到了8000多篇论文以及2.8万多条评审意见,一篇论文一般对应3~4条评审意见。

  但爬取的这些评审意见数据,都是纯文本形式的,AI系统是无法理解的。“我们需要对评审意见里的信息进行‘表征’定义,然后,我们采取了一种半人工半自动的方法,对数据集进行标注。”袁玮哲表示,最终得到了质量非常高的数据集。

  在其后的模型训练环节,研究人员先在论文中抽取一些非常重要的句子,用这些句子来做评审意见的生成。在这种先抽取后生成的框架下,他们综合运用了2种抽取策略以及两种生成策略,并最终成功形成了AI自动审稿系统“ReviewAdvisor”。

  伦理

  AI自动审稿系统“ReviewAdvisor”出来后,得到了很多正向的反馈。有人在试用了该系统后,表示该系统生成的评审意见,比过去他收到的一些由专家写的意见更具有建设性。

  那么,论文审稿人真的就要被替代了吗?

  在对一些客观条件识别方面,“ReviewAdvisor”具有明显的优势。例如论文违反了匿名规则,系统可以很快识别出来,直接给出“拒稿”意见。

  但是,“我们的系统也会生成带有偏见的评审意见。”袁玮哲说。

  对于英语为母语的作者的论文和非英语为母语的作者的论文,由人写的评审意见和系统生成的评审意见都认为,在论文的“清晰性”方面,英语为母语的作者表现得更好。袁玮哲认为,这或许是有一定道理的,“确实非英语为母语的作者在写文章时,用英语表达观点会有一些困难”。

  但是,系统生成的评审意见还得出“英语为母语的作者的论文更具有创新性”。袁玮哲说,这可能是系统目前在“偏见”方面存在的比较显著的问题。

  研究论文提交后,谷歌公司科学家在推特上说,“可以尝试一下这个系统,但千万不要用这个系统的结果取代审稿工作,否则也太对不起被审论文的作者了”。

[ 责编:武玥彤 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 成都世园会场馆巡礼

  • 戈壁大漠 驼羔盛会

独家策划

推荐阅读
从1999年起,有着“神箭”称号的长二F火箭全程参与了中国载人航天工程“三步走”战略的每一步。它用100%的成功率,为航天员搭建出一条安全“天梯”。
2024-04-26 09:33
近期,人工智能(AI)+机器人赛道广受关注。尤翔宇表示,梳理人形机器人产业技术发展脉络,主要有底层硬件、运动控制和具身智能3条路线。优必选相关负责人表示,未来,公司将聚焦人形机器人的三大应用场景,包括工业制造、商用服务和家庭陪伴。
2024-04-26 09:41
中国工程院院士、中国探月工程总设计师吴伟仁在4月24日举行的2024年中国航天大会主论坛上透露,我国计划于2030年前后发射天问三号探测器,实施火星采样返回任务。
2024-04-26 09:40
春日里,云南双江县各大茶山的春茶迎来开采季。北回归线横穿而过的双江,拥有适宜茶树生长发育的自然条件,现有以“冰岛茶”为代表的百年以上栽培型古茶树3.69万亩。
2024-04-26 09:35
每年,都有这样一群“空中旅客”,南北来回奔波。迁徙之路漫长曲折,一路充满生死考验,它们却高声歌唱,不知疲倦地追逐着自己的目标。
2024-04-26 09:34
力争在生命科学等领域达到全球领先水平,在颠覆性技术和关键核心技术上实现重大突破;打造高水平人才集聚地,人才梯队体系较为完备,成为全球向往的创业乐土。
2024-04-26 09:26
4月25日20时59分,搭载神舟十八号载人飞船的长征二号F遥十八运载火箭在酒泉卫星发射中心点火发射,约10分钟后,神舟十八号载人飞船与火箭成功分离,进入预定轨道。航天员乘组状态良好,发射取得圆满成功。
2024-04-26 09:24
朱松纯表示,“通通”在日常学习与训练中,使用的A100芯片不超过10块,这意味着“通通”不依赖庞大的算力和海量数据就能学习成长。“通通”也可以与具身智能机器人相结合,为智能制造、智慧城市、医疗健康等领域带来革命性变化。
2024-04-26 09:38
日前,农业农村部发布非主要农作物品种登记撤销公告,撤销向日葵、黄瓜、甜瓜、油菜等问题品种312个,切实推进登记品种从严规范管理,持续营造激励创新、公平竞争的市场环境。
2024-04-25 10:36
英国牛津大学和美国麻省理工学院领导的一项新研究恢复了37亿年前的地球磁场记录,发现它与今天地球周围的磁场非常相似。
2024-04-25 10:34
“载人月球探测工程登月阶段任务经中央政府批准启动实施,总体目标是2030年前实现中国人登陆月球,目前各系统正按计划开展研制建设。神舟十七号航天员乘组在与神舟十八号航天员乘组完成在轨轮换后,计划于4月30日返回东风着陆场。
2024-04-25 10:32
国家卫健委24日发布的数据显示,2023年,我国居民健康素养水平达到29.7%,比2022年提高1.92个百分点,继续呈现稳步提升态势。 据了解,本次监测覆盖31个省(自治区、直辖市)的336个县(区)1008个乡镇(街道),对象为15岁至69岁的常住人口,共得到有效调查问卷73340份。
2024-04-25 10:30
中央气象台预计,24日夜间至26日白天,江南、华南等地雨势将再度加强,其中广东中部和西北部、广西东北部等地有大暴雨,局地伴有雷暴大风等强对流天气。
2024-04-25 10:28
日前,中国纤维质量监测中心发布2023年度新疆棉花生产加工过程质量状况监测结果。
2024-04-24 10:33
1998年,聂海胜成为我国首批航天员,先后执行过神舟六号、神舟十号、神舟十二号3次载人飞行任务。
2024-04-24 10:17
在北京航天飞行控制中心的统一调度下,酒泉卫星发射中心、西安卫星测控中心以及任务各测控站点实施联调联控,全面模拟发射准备、发射以及飞行过程中的各种技术状态和工作过程。
2024-04-24 10:16
1996年,我从技校毕业后,来到金川公司工作。当时总听师傅们讲,贵金属冶炼技术难以突破。提高我国铂族贵金属提炼的技术水平,对于守护国家安全极为必要。
2024-04-24 10:14
截至2023年底,我国大陆在运核电机组55台,总装机容量为57吉瓦,核准及在建核电机组36台,总装机容量为44吉瓦;全年核电发电量44万吉瓦时,占全国累计发电量近5%,相当于节约标煤1.3亿吨,减排二氧化碳3.5亿吨。
2024-04-24 10:05
截至2022年末,我国电动自行车社会保有量已达3.5亿辆。2023年,全国规模以上企业累计生产电动自行车4228万辆。
2024-04-23 04:00
22日是第55个世界地球日,今年的主题为“全球战塑”。国家发展和改革委员会宏观经济研究院经济体制与管理研究所当日发布的《废塑料化学循环综合性研究报告》显示,
2024-04-23 04:25
加载更多