Turnitin报告中的匹配占比跟论文页数有关系吗,长篇论文和短篇哪个更吃亏?
同样一个关于某个理论框架的描述——在一篇 5000 词的短篇论文里出现了 50 词的跟已有文献匹配,贡献的相似度是 1%。在一篇 2000 词的短评里同样的 50 词重合——占比达到了 2.5%。从百分比的角度来看——同样是写了某一句"学术界常用的安全表达",短篇论文遭受的"百分比的放大效应"要显著高于长篇论文。
这就是为什么 Turnitin 的相似度百分比不能脱离论文篇幅去理解。短篇论文中——一个固定长度的匹配在分母上的占比天然更高——同等写作独立性下,短论文的相似度会"看起来更差"。长篇论文中——即便有不少匹配,巨大的总词量作为分母会把这些匹配稀释到更低的百分比区间。你的导师在阅读一篇 1500 词课程短文的查重报告时——对这个效应通常有经验性的认知——他不会因为你 18% 的分数而感到不安,如果他知道你的 18% 主要是一两个较长引用和参考文献贡献的,而你的论文本身篇幅短。