你下载好 Turnitin 查重报告压缩包,解压后看到好几份文件,最常见的情况是:一份 PDF 总报告,一份文件名里带 include_bibliography,一份带 exclude_bibliography。很多同学先打开 PDF,看到相似率数字后就开始紧张,甚至误以为参考文献被标红就是“重复率超标”,于是去改动文献表。这样反而会掩盖正文中真正需要处理的重复。要读懂 Turnitin 报告压缩包,关键是先理解三份文件分别代表什么,再用 include 与 exclude 两版去对照参考文献对总重复率的贡献。

一、先分清压缩包里三份文件各自代表什么

不要只看 PDF 总报告。压缩包里的三份文件分别承担不同的作用,你可以先把它们对应起来:

文件通常代表什么你应该怎么看
PDF 总报告学校最可能认的最终凭证,显示一个总相似率先看数字,但要确认它对应哪种过滤设置,不能只看一个百分比
include_bibliography 版参考文献列表一同参与匹配的版本用来观察参考文献把总分抬高了几个百分点
exclude_bibliography 版系统尝试排除参考文献后的版本更接近摘要、正文、讨论等核心部分的重复情况

你不应默认三份文件的差别只来自参考书目。打开 exclude 版时,先看报告内的过滤设置:是否只勾选了排除参考书目,是否还排除了引用资料、小型匹配或自引。如果设置不同,两个版本的数字差就不能完全归因于参考文献。

二、用 include 与 exclude 对照,看参考文献对总重复率的影响

第一步,把 include 和 exclude 两个文件并排打开,分别记录它们的总相似率百分比。

第二步,对比两个总相似率的差值。例如 include 版显示 28%,exclude 版显示 19%,差值约 9 个百分点。这个差值不一定都等于参考文献的“纯贡献”,但它是你接下来要定位的信号:先进入 exclude 版,翻到文末的参考文献列表,看那些条目是继续保持红色或彩色高亮,还是已经变成灰色或不再标记。如果参考文献区在 exclude 版中大部分不再标红,而 include 版中大面积标红,说明系统已经识别到你的参考文献列表并成功过滤;此时 exclude 版的总重复率更接近你正文中实际被匹配的文字量。

第三步,确认学校或导师按哪一版要求。你可查看教务处、学院或课程通知中的表述:如果写的是“去除参考文献后重复率不得超过 X%”,那对应应看 exclude_bibliography 版;如果只要求提交 PDF 总报告,就要向指导老师确认这份总报告是否已经勾选了排除参考书目。不要只用对自己最有利的数字去解释,以免后续被退回。

第四步,把“总相似率”拆成“参考文献区贡献 + 正文区贡献”。这样即使 include 版数字偏高,你也不必慌;真正决定你是否需要修改正文的,是正文区那些被高亮、且不属于引用规范的连续重复。

三、排除版里参考文献仍标红,先检查引用格式,不要改书目事实

有些同学打开 exclude 版后,发现参考文献列表仍然整片标红,于是误以为参考文献本身“重复过高”,开始改作者名、年份、期刊名或页码。这往往是错的方向。Turnitin 排除参考书目并不是在判断每条文献是否真实、是否被正确著录,而是依靠文档中的标题词和区域标记来识别“从这里开始是参考文献列表”。官方帮助中列出的可触发排除的词语包括“参考文献”“参考书目”“引用文献”“引用书籍”“书目资料”等;当文档后面出现“附录”“致谢”等词时,系统又可能恢复相似度检查。

如果你出现“exclude 版里参考文献仍标红”,不要急着改书目事实,而是按下面顺序检查:

第一,看你的参考文献列表上方是否有明确、单独的“参考文献”标题。标题写成了“主要参考资料”或“本文引用的文献”时,系统未必能识别为标准的参考文献起点;如果标题缺失,后边的书目条目就可能被当作正文继续参与匹配。

第二,看“参考文献”四字是否和正文最后一段粘连在同一段落里。标题最好单独一行,不要接在结论段后边,也不要和最后一个正文句共用一段。

第三,查看文章里是否在参考文献之前出现了“附录”“致谢”等终止类字样。如果你的论文目录或前文中出现了这些词,系统可能在还没到文献表时就恢复了检查,导致过滤失效。

第四,把正文中所有与参考文献无关的段落从文献区清出去。如果文献表混入了脚注说明、网址列表或大段说明文字,系统可能无法干净地截断整个书目区域。

可执行的示例检查动作如下:打开 exclude 版,翻到文末,找到第一条参考文献条目。如果它从第一条到最后一条都被红色覆盖,重点看第一条上方的标题;如果只有某几条被标红,则要点开匹配来源,看是不是这些条目本身与某些公开文献或网页内容高度一致,例如常见标准著录格式里的固定字段。属于标准著录格式的固定字段即使被标红,通常也属于参考文献格式带来的“系统性相似”,不是正文重复。

去标识化示例:

[1] 某某某. 某种机理的数值模拟研究[J]. 某大学学报, 2023, 40(2): 15-22.

如果这条例上面没有“参考文献”标题,就可能被计入重复。补上单独成段的“参考文献”后,exclude 版中这部分通常会变为不参与匹配。需要说明,这里补标题是规范引用格式,而不是以规避检测为目的。

四、摘要和正文的共同高亮,才是真正需要处理的重复

把 include 版和 exclude 版放在一起看,你会注意到一个规律:摘要、引言、研究方法、结果和讨论部分的高亮位置,在两个版本中基本一致;差别主要集中在文末参考文献区,其次是致谢或附录附近。这个差异本身就是一个判断工具:如果某段正文在 include 和 exclude 里都持续标红,它不会因为排除参考文献而消失,说明它处在系统的“参考文献区域”之外,属于需要你认真核对的重复内容。

因此,当你想用这三份文件决定下一步怎么修改时,正确的顺序不是先看总分数,也不是先删文献表,而是:

  1. 用 exclude 版先圈出正文中的红色高亮,忽略已经成功过滤的参考文献区。
  2. 对每处正文高亮点开匹配来源,区分“合理引用”“固定术语”和“连续文字重复”。合理引用可以保留,固定术语需要保持规范,连续文字重复才需要改写。
  3. 把真正需要改写的段落在原稿中单独标出,按自己的理解重写后,再重新检测,观察正文高亮是否减少,而不是观察参考文献区颜色。
  4. 如果 include 与 exclude 的总相似率差值仍然很大,而正文高亮很少,说明参考文献贡献较大;你可向老师解释两版数字,但不要用修改文献事实的方式来把 include 的数字降下来。

对于参考文献重复率,你的目标是让它被系统正确识别为“参考文献区域”而滤除,而不是让每条文献的内容不再被匹配。文献条目本来就是要被精确、规范地列出的,它和正文中抄来的句子是两回事。读懂 include 与 exclude 两版的核心,就是区分这两类标红:一类来自文献列表格式,一类来自正文写作中的重复。

逐项自查动作可以归纳为下面几步:

  • 解压后先列清单,确认自己手上有 PDF 总报告、include_bibliography 版、exclude_bibliography 版。
  • 查看 exclude 版报告内部是否勾选了“排除参考书目”,确认不是自己手动关掉了过滤。
  • 用 include 减 exclude 得到差值,进入排除版查看参考文献区是否仍然标红。
  • 若排除版参考文献仍标红,检查“参考文献”标题是否单独成段、是否使用了系统能识别的标题词、文献区前后是否混入致谢或附录。
  • 对比摘要、正文在两版中的高亮,标记共同高亮部分,只对这些正文重复做合规改写。
  • 最终以学校或导师要求的版本口径解释相似率,并在答辩或提交说明中写清自己参考的是哪个版本。

这样使用 Turnitin 报告压缩包里的三份文件,你就能把“总相似率多少”这个笼统问题,拆成“参考文献占了多少、正文真正重复了多少、哪些需要改、哪些不该改”四个可操作的判断。

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。