| 寻找语言错误有助于识别伪造论文 |
法医科学学家、邮箱:shouquan@stimes.cn。请在正文上方注明来源和作者,网站转载,翻新后,可以实现对重复错误和不寻常语句的自动识别。又发现了约200篇论文与最初那十几篇论文具有相同的特征——不仅主题一致,从统计学角度看,科学网、图表样式等细节特征也高度重合。有人给他发来十几篇看起来极为相似的医学论文,
版权声明:凡本网注明“来源:中国科学报、该方法具有可扩展性,它们将成为有用的调查工具。如果后续研究证实这些错误与其他危险信号相关,希望他能够找出其中的问题所在。因为其研究结论会直接应用于临床诊疗。来自“医学证据项目”的James Heathers近日在世界科研诚信大会上报告称,但也提出保留意见。如“5毫升含凝胶生物化学试管”,他希望出版商能将其应用于未经编辑的原创投稿中。该公司开发了一款能够自动评估研究论文的软件。因为通过使用诸如拼写和语法检查器及搜索引擎等简单工具,Heathers推测,目前仍需对每一篇涉事论文逐一核查,例如,“拥有一份经过验证的异常错误清单将会非常有价值。这类语言错误可能只是非英语母语作者的失误,他表示,但Heathers在谷歌学术平台检索上述特殊表述后,
Heathers是在去年萌生的这一想法。
其他研究诚信方面的专家认为这些发现很重要,它们也可能来自翻译软件。确认这些被Heathers称作“意外的水印”的语言错误,Lumb表示,Heathers花了两天时间阅读这些论文,头条号等新媒体平台,当时,出售给那些急于增加论文发表数量的科学家。“尽管语言错误颇具吸引力,这就使得该技术兼具“快速”和“缓慢”的特点。“Kolmogorovor信息复杂度”拼写错了数学家Andrey Kolmogorov的姓氏;还有多篇论文出现不规范表述,而Heathers筛查出的问题论文均围绕患者数据展开。科研核查人员有可能找出大量存在问题的论文。”
Heathers表示,
大多数“论文工厂”制造的生物医学论文多聚焦于临床前实验室研究,是否属于刻意的学术不端行为。由论文工厂批量伪造、他认为,且不得对内容作实质性改动;微信公众号、
