你下载好 Turnitin 查重报告压缩包,解压后看到好几份文件,最常见的情况是:一份 PDF 总报告,一份文件名里带 include_bibliography,一份带 exclude_bibliography。很多同学先打开 PDF,看到相似率数字后就开始紧张,甚至误以为参考文献被标红就是“重复率超标”,于是去改动文献表。这样反而会掩盖正文中真正需要处理的重复。要读懂 Turnitin 报告压缩包,关键是先理解三份文件分别代表什么,再用 include 与 exclude 两版去对照参考文献对总重复率的贡献。
一、先分清压缩包里三份文件各自代表什么
不要只看 PDF 总报告。压缩包里的三份文件分别承担不同的作用,你可以先把它们对应起来:
| 文件 | 通常代表什么 | 你应该怎么看 |
|---|---|---|
| PDF 总报告 | 学校最可能认的最终凭证,显示一个总相似率 | 先看数字,但要确认它对应哪种过滤设置,不能只看一个百分比 |
| include_bibliography 版 | 参考文献列表一同参与匹配的版本 | 用来观察参考文献把总分抬高了几个百分点 |
| exclude_bibliography 版 | 系统尝试排除参考文献后的版本 | 更接近摘要、正文、讨论等核心部分的重复情况 |
你不应默认三份文件的差别只来自参考书目。打开 exclude 版时,先看报告内的过滤设置:是否只勾选了排除参考书目,是否还排除了引用资料、小型匹配或自引。如果设置不同,两个版本的数字差就不能完全归因于参考文献。
二、用 include 与 exclude 对照,看参考文献对总重复率的影响
第一步,把 include 和 exclude 两个文件并排打开,分别记录它们的总相似率百分比。
第二步,对比两个总相似率的差值。例如 include 版显示 28%,exclude 版显示 19%,差值约 9 个百分点。这个差值不一定都等于参考文献的“纯贡献”,但它是你接下来要定位的信号:先进入 exclude 版,翻到文末的参考文献列表,看那些条目是继续保持红色或彩色高亮,还是已经变成灰色或不再标记。如果参考文献区在 exclude 版中大部分不再标红,而 include 版中大面积标红,说明系统已经识别到你的参考文献列表并成功过滤;此时 exclude 版的总重复率更接近你正文中实际被匹配的文字量。
第三步,确认学校或导师按哪一版要求。你可查看教务处、学院或课程通知中的表述:如果写的是“去除参考文献后重复率不得超过 X%”,那对应应看 exclude_bibliography 版;如果只要求提交 PDF 总报告,就要向指导老师确认这份总报告是否已经勾选了排除参考书目。不要只用对自己最有利的数字去解释,以免后续被退回。
第四步,把“总相似率”拆成“参考文献区贡献 + 正文区贡献”。这样即使 include 版数字偏高,你也不必慌;真正决定你是否需要修改正文的,是正文区那些被高亮、且不属于引用规范的连续重复。
三、排除版里参考文献仍标红,先检查引用格式,不要改书目事实
有些同学打开 exclude 版后,发现参考文献列表仍然整片标红,于是误以为参考文献本身“重复过高”,开始改作者名、年份、期刊名或页码。这往往是错的方向。Turnitin 排除参考书目并不是在判断每条文献是否真实、是否被正确著录,而是依靠文档中的标题词和区域标记来识别“从这里开始是参考文献列表”。官方帮助中列出的可触发排除的词语包括“参考文献”“参考书目”“引用文献”“引用书籍”“书目资料”等;当文档后面出现“附录”“致谢”等词时,系统又可能恢复相似度检查。
如果你出现“exclude 版里参考文献仍标红”,不要急着改书目事实,而是按下面顺序检查:
第一,看你的参考文献列表上方是否有明确、单独的“参考文献”标题。标题写成了“主要参考资料”或“本文引用的文献”时,系统未必能识别为标准的参考文献起点;如果标题缺失,后边的书目条目就可能被当作正文继续参与匹配。
第二,看“参考文献”四字是否和正文最后一段粘连在同一段落里。标题最好单独一行,不要接在结论段后边,也不要和最后一个正文句共用一段。
第三,查看文章里是否在参考文献之前出现了“附录”“致谢”等终止类字样。如果你的论文目录或前文中出现了这些词,系统可能在还没到文献表时就恢复了检查,导致过滤失效。
第四,把正文中所有与参考文献无关的段落从文献区清出去。如果文献表混入了脚注说明、网址列表或大段说明文字,系统可能无法干净地截断整个书目区域。
可执行的示例检查动作如下:打开 exclude 版,翻到文末,找到第一条参考文献条目。如果它从第一条到最后一条都被红色覆盖,重点看第一条上方的标题;如果只有某几条被标红,则要点开匹配来源,看是不是这些条目本身与某些公开文献或网页内容高度一致,例如常见标准著录格式里的固定字段。属于标准著录格式的固定字段即使被标红,通常也属于参考文献格式带来的“系统性相似”,不是正文重复。
去标识化示例:
[1] 某某某. 某种机理的数值模拟研究[J]. 某大学学报, 2023, 40(2): 15-22.
如果这条例上面没有“参考文献”标题,就可能被计入重复。补上单独成段的“参考文献”后,exclude 版中这部分通常会变为不参与匹配。需要说明,这里补标题是规范引用格式,而不是以规避检测为目的。
四、摘要和正文的共同高亮,才是真正需要处理的重复
把 include 版和 exclude 版放在一起看,你会注意到一个规律:摘要、引言、研究方法、结果和讨论部分的高亮位置,在两个版本中基本一致;差别主要集中在文末参考文献区,其次是致谢或附录附近。这个差异本身就是一个判断工具:如果某段正文在 include 和 exclude 里都持续标红,它不会因为排除参考文献而消失,说明它处在系统的“参考文献区域”之外,属于需要你认真核对的重复内容。
因此,当你想用这三份文件决定下一步怎么修改时,正确的顺序不是先看总分数,也不是先删文献表,而是:
- 用 exclude 版先圈出正文中的红色高亮,忽略已经成功过滤的参考文献区。
- 对每处正文高亮点开匹配来源,区分“合理引用”“固定术语”和“连续文字重复”。合理引用可以保留,固定术语需要保持规范,连续文字重复才需要改写。
- 把真正需要改写的段落在原稿中单独标出,按自己的理解重写后,再重新检测,观察正文高亮是否减少,而不是观察参考文献区颜色。
- 如果 include 与 exclude 的总相似率差值仍然很大,而正文高亮很少,说明参考文献贡献较大;你可向老师解释两版数字,但不要用修改文献事实的方式来把 include 的数字降下来。
对于参考文献重复率,你的目标是让它被系统正确识别为“参考文献区域”而滤除,而不是让每条文献的内容不再被匹配。文献条目本来就是要被精确、规范地列出的,它和正文中抄来的句子是两回事。读懂 include 与 exclude 两版的核心,就是区分这两类标红:一类来自文献列表格式,一类来自正文写作中的重复。
逐项自查动作可以归纳为下面几步:
- 解压后先列清单,确认自己手上有 PDF 总报告、include_bibliography 版、exclude_bibliography 版。
- 查看 exclude 版报告内部是否勾选了“排除参考书目”,确认不是自己手动关掉了过滤。
- 用 include 减 exclude 得到差值,进入排除版查看参考文献区是否仍然标红。
- 若排除版参考文献仍标红,检查“参考文献”标题是否单独成段、是否使用了系统能识别的标题词、文献区前后是否混入致谢或附录。
- 对比摘要、正文在两版中的高亮,标记共同高亮部分,只对这些正文重复做合规改写。
- 最终以学校或导师要求的版本口径解释相似率,并在答辩或提交说明中写清自己参考的是哪个版本。
这样使用 Turnitin 报告压缩包里的三份文件,你就能把“总相似率多少”这个笼统问题,拆成“参考文献占了多少、正文真正重复了多少、哪些需要改、哪些不该改”四个可操作的判断。


