排除参考文献后相似度仍然很高的技术性与格式性原因
在查看 Turnitin 查重报告时,勾选"排除参考文献"是学生最常使用的过滤操作之一——它的预期效果是将论文末尾的参考文献列表从相似度计算中移除,从而使百分比更准确地反映正文的重复状况。然而,许多学生在执行这一操作后发现——报告的相似度并未出现预期的显著下降,参考文献区域的标黄仍然大面积存在。这种现象在学生中引发了关于 Turnitin 排除功能是否可靠的技术性质疑。
排除参考文献功能未能正常生效的原因,在多数情况下可以追溯到论文中参考文献格式的规范性问题。Turnitin 对参考文献的自动识别并非通过纯粹的视觉判断——它依赖于对特定格式模式的分析来定位参考文献区域的起始和终止边界。当前的 Turnitinuk 比对引擎在英文论文中采用机器学习算法来识别参考文献条目,该算法对格式高度标准化的参考文献列表的识别准确率相对较高——APA、MLA、Chicago、Vancouver 等常见引用格式的严格排版版本通常能够被正确识别。但当参考文献格式存在以下几种不规范情况时——条目之间的段落分隔不标准、某些条目的格式化信息缺失(缺少年份或卷号)、或者在参考文献列表中混合了非标准的注释性文本——系统的识别准确率可能出现显著下降,导致部分或全部参考文献条目被排除功能遗漏。
对于非英文参考文献的识别问题同样值得注意。Turnitin 对以拉丁字母为基础的语言(如法语、德语、西班牙语)的参考文献识别效果大致与英文相当,但对以非拉丁文字书写的参考文献(中文、日文、韩文、阿拉伯文等)的自动识别能力存在可预见的下降。当论文的参考文献列表中含有大量非英文引用条目时,这部分内容的排除可能不完全。
此外,参考文献关键词的不当使用也可能干扰排除功能。Turnitin 通过在论文中搜索特定的章节标题关键词——如"References""Bibliography""Works Cited"等——来定位参考文献区域的起点。当这些关键词在论文的其他位置被意外使用——例如在目录中、在正文中的某行单独出现、或在表格中被引用——系统可能因此错误判断参考文献区域的边界,导致排除范围异常。预防这一问题的有效方法是——确保参考文献章节的关键词仅作为该章节的正式标题使用,避免在正文的其他任何位置单独引用这些术语。
当自动排除未能完全处理参考文献匹配时,学生可以采用的补充措施是手动逐一排除残留的参考文献匹配来源。在 turnitin查重 报告界面中,学生可以点开来源列表,识别出那些主要由参考文献条目组成的匹配来源,并通过逐来源排除的功能将其临时移除。需要了解的是——学生在自己的查看界面中进行的任何排除操作均不会影响教师端所看到的默认报告状态。因此,如果学生希望教师看到的是排除了参考文献之后的相似度数字——需要主动与教师沟通,请教师在教师端对报告进行同样的排除设置。