Articles
iThenticate检测中合理自引与不当重复利用的边界划分
在iThenticate的相似度报告中,匹配来源的"作者身份"是一个在判断匹配性质时具有决定意义的变量。当一篇稿件的最高匹配来源被识别为该稿件作者本人在此前已发表的作品时——这一匹配被归类为"自引匹配"。自引匹配本身不是学术不端——恰恰...
正文
在iThenticate的相似度报告中,匹配来源的"作者身份"是一个在判断匹配性质时具有决定意义的变量。当一篇稿件的最高匹配来源被识别为该稿件作者本人在此前已发表的作品时——这一匹配被归类为"自引匹配"。自引匹配本身不是学术不端——恰恰相反,研究者在同一研究领域持续产出成果的过程中,必然会产生一定程度的与前作之间的文本延续。问题在于——这种延续在什么条件下是"可接受的合理自引",在什么条件下滑向了"不应被接受的不当重复利用"。
合理自引的核心特征是——前作文本在新作中被复用,但新作在学术贡献上与前作之间存在实质性的差异和进展。合理自引最常见的应用场景包括——在新研究的方法部分参考和沿用自己此前已验证有效的实验方案(并进行适当的引用标注);在背景介绍部分简要复述自己此前已发表的研究发现,以此为新研究的假设推导提供基础;在基金申请书的前期工作基础部分,引用自己的已发表成果来证明研究团队的学术能力。在这些场景中,自引的功能是提供学术背景和建立研究延续性——被复用的文本在学术功能上是辅助性的而非核心原创性的。
不当重复利用的特征则是——前作文本在新作中被复用,但新作在学术贡献上并未与前作构成实质性的差异。典型的不当重复利用包括——将已发表论文的核心分析段落(尤其是结论部分)在新的投稿中几乎原样复现,而未提供新的数据或新的分析视角;将同一组研究发现通过小幅改写分发到多个不同期刊,以获取多重发表记录——即"香肠切片"式的冗余发表;以及将已发表的会议论文在未做实质性扩展的情况下直接改投期刊。ICMJE 和 COPE 对这些行为的立场是一致的——它们损害了学术文献的信度和研究资源分配的效率。
对于研究者在自查阶段遇到的 iThenticate 自引匹配,判断其是否属于"合理自引"的一个实用分析框架是基于——位置维度、功能维度和比例维度。在位置维度上,出现在方法和引言部分的自引匹配,通常处于合理区间;出现在讨论和结论部分的自引匹配,值得认真审视其是否包含了应被独立分析的原创内容。在功能维度上,为建立研究的连续性和为前人工作提供引用标注而进行的自引,属于合理范畴;为节省写作时间和降低原创门槛而进行的大规模文本迁移,属于需要纠正的范畴。在比例维度上,单篇稿件中自引内容的占比如果在整体上过高——即使每个自引段落在个体上都是标注了出处的——也可能意味着这篇稿件在学术贡献的独立性上存在整体性的不足。ithenticate查重通过提供详细的来源身份和匹配分布信息,帮助研究者在自查时对自引的性质做出这一多维度的判断。ithenticate中文网站提供了自引处理与学术诚信的更多实践分析。