打开相似度报告时,很多人会先勾选“排除参考文献”再看一眼分数。可奇怪的是,有的论文勾选前后分数几乎没变,有的却明显下降,还有的反而让人更糊涂:明明参考文献已经排除了,为什么相似度还是那么高?
这不是系统出错了,而是“排除参考文献”这个过滤器的工作方式,跟很多人想的不太一样。它做的不是把每一处引用都从报告里拿掉,而是自动识别论文末尾的参考文献区域,把这一整段从相似度计算中忽略掉。换句话说,它处理的是“参考文献列表”这个位置,而不是“所有提到他人成果的地方”。
参考文献条目为什么能把分数推高
参考文献列表对相似度的贡献,往往比想象中更大。Turnitin 的匹配规则是逐段比对文本,而参考列表里的每一条条目,几乎都会和数据库里某个来源对上:作者、标题、期刊、年份,这些信息本身就是从原文复制过来的。于是一个常见的画面出现了:参考列表里每条条目对应着不同来源,整页显示成五颜六色的色块,像一道彩虹。
这些色块单看都很小,但几十条参考文献累计起来,就会形成一个相当可观的百分比。这正是“排除参考文献”过滤器存在的意义:它要把这类由格式性信息造成的匹配从分数里剔除,让相似度更接近正文的真实情况。
所以,如果你勾选排除参考文献后分数明显下降,通常说明推高相似度的主要是参考列表里的文献信息,而不是正文中的文字重复。这本身不是问题,反而是引用规范的体现。
分数没变,问题可能出在正文
另一种情况更值得注意:排除参考文献后分数几乎没动。这说明推高相似度的主要不是参考列表,而是正文中的文本匹配。
这时需要打开匹配色块逐段看。正文里被标亮的文本,大致可以分成几类。一类是直接引用,如果引文用了正确的引号格式,并且来源被标出,这类匹配通常属于正常引用;一类是改写不够彻底的段落,文字和来源过于接近,即使换了几个词,整体结构仍然和原文一致;还有一类是学科内必须保留的固定表达,比如专业术语、题目表述、方法名称,这类匹配很难通过改写消除,也不需要消除。
判断修改重点时,要区分“引用了”和“重复了”。一段文字只要标明了出处,就不算学术不端,但如果它的措辞几乎照搬原文,即使标了引用,仍然属于改写不充分。反过来,一段没有标引用的文字,即使只是部分相似,也需要认真处理。
引用项累计:被计入的未必都是问题
还有一个容易让人困惑的点:报告里显示的相似度,是把所有匹配来源累计后算出来的。也就是说,哪怕你的论文里每一处引用都规范,只要引用数量多,累计起来的百分比也会偏高。这就是为什么不要只盯着一个固定数字判断论文是否安全。
核对被计入的引用项时,可以按这样的顺序看。先看匹配来源列表,确认每个来源是否真的被正确引用;再看匹配文本的性质,是引号内的直接引文,还是未加引号的改写段落;最后看参考列表本身,如果某一条参考文献的色块是单一颜色,说明整条条目整体匹配了某一个来源,这可能意味着参考列表本身是从别处复制的,需要重新整理。
参考列表里常见的“彩虹”式色块,也就是每条条目各自匹配不同来源,通常不需要担心,它反映的是你确实阅读并引用了不同文献。而单一颜色的整条匹配,才需要仔细核对。
排除引用、排除小匹配这些选项别混着用
在报告设置里,除了排除参考文献,还有排除引用文本、排除小匹配等选项。这些过滤器的逻辑各不相同,别把它们当成一回事。
排除引用文本,针对的是正文中被识别为直接引用的部分;排除小匹配,则是按来源级别过滤掉匹配内容很少的来源。它们和排除参考文献并不冲突,但使用时要清楚:每开一个过滤器,分数都会重新计算,而过滤后的分数只是帮助你聚焦重点的视图,不代表论文内容的真实质量。
另外要留意,学生端对报告做的排除设置,通常只是临时视图,不会改变教师端看到的官方相似度分数。如果论文提交后,教师那边显示的分数和你自己排除后看到的不一致,原因往往就在这里。想要正式调整分数,需要联系任课教师,由教师端处理,而不是自己在报告里改设置。
重新定义“真实重复”的边界
回到最初的问题:排除参考文献前后分数不一致,到底说明了什么?
它说明的其实是一件事:相似度分数是一个累计结果,把不同性质的匹配混在了一起。参考列表的匹配、直接引用的匹配、改写不彻底的匹配、学科固定表达的匹配,全部加在一起,才形成你看到的百分比。排除参考文献,只是把其中一类拿掉,让你看清剩下部分的分量。
真正的修改重点,应该放在正文中那些未加引号、又和来源措辞过于接近的段落上。这类匹配无论排除哪个过滤器都会保留,因为它们才是“真实重复”的核心。而参考列表、规范引文、学科术语带来的匹配,属于正常学术写作的一部分,不必为了压低分数而刻意改动。
下次再看到排除参考文献后的分数,不妨先问自己三个问题:分数下降的幅度,主要来自参考列表还是正文?正文里剩下的匹配,是引号内的直接引文,还是需要进一步改写的段落?参考列表里,有没有整条匹配单一来源的异常条目?把这三个问题弄清楚,比记住任何一个固定分数都有用。


