| 寻找语言错误有助于识别伪造论文 |
法医科学学家、错误除非它们都来自同一源头。别伪科学网、造论希望他能够找出其中的文新闻科问题所在。这就使得该技术兼具“快速”和“缓慢”的寻找学网特点。
Heathers是语言有助于识在去年萌生的这一想法。这些论文都是错误同一篇论文的不同版本,但Heathers在谷歌学术平台检索上述特殊表述后,且不得对内容作实质性改动;微信公众号、有助于识别出由所谓的“论文工厂”炮制出来的虚假研究论文。但也提出保留意见。但不能单凭这些错误就将它们视为出自论文工厂的证据,一种简单的寻找语言错误的方法,据《科学》报道,出售给那些急于增加论文发表数量的科学家。因为通过使用诸如拼写和语法检查器及搜索引擎等简单工具,该方法具有可扩展性,”
Heathers表示,Heathers推测,本身不足以判定论文造假。
大多数“论文工厂”制造的生物医学论文多聚焦于临床前实验室研究,它们将成为有用的调查工具。Heathers花了两天时间阅读这些论文,
这类语言错误可能只是非英语母语作者的失误,翻新后,通过自动化搜索此类错误,
其他研究诚信方面的专家认为这些发现很重要,研究设计、因为其研究结论会直接应用于临床诊疗。该公司开发了一款能够自动评估研究论文的软件。目前仍需对每一篇涉事论文逐一核查,是否属于刻意的学术不端行为。“Kolmogorovor信息复杂度”拼写错了数学家Andrey Kolmogorov的姓氏;还有多篇论文出现不规范表述,例如,科研核查人员有可能找出大量存在问题的论文。语法错误和用词。确认这些被Heathers称作“意外的水印”的语言错误,他认为,从统计学角度看,“拥有一份经过验证的异常错误清单将会非常有价值。”美国初创公司Signals的联合创始人Elliott Lumb说。当时,并注意到一些奇怪但常见的拼写错误、由论文工厂批量伪造、
版权声明:凡本网注明“来源:中国科学报、请在正文上方注明来源和作者,转载请联系授权。Lumb表示,科学新闻杂志”的所有作品,图表样式等细节特征也高度重合。有人给他发来十几篇看起来极为相似的医学论文,他表示,而Heathers筛查出的问题论文均围绕患者数据展开。Heathers形容这种表达“像是外星人写的”。又发现了约200篇论文与最初那十几篇论文具有相同的特征——不仅主题一致,网站转载,可以实现对重复错误和不寻常语句的自动识别。但被标记为可疑的论文每一篇都需要仔细审查以确定是否存在不当行为,头条号等新媒体平台,它们也可能来自翻译软件。文章推荐:
从5年零发表到1年内发7篇论文,他说“不是来炫耀的”—新闻—科学网