进入9月,本科毕业论文陆续进入送检阶段。面对查重报告首页的多个百分比,最常被混淆的是“总文字复制比”和“去除引用文献复制比”。两项指标虽然并列出现,但统计口径并不相同,读懂二者差异,是准确核对送检结果的第一步。
两项复制比各统计什么
“总文字复制比”是检测系统对全文与对比库重合程度的总体度量,其计算方式通常为全文重合字数除以检测总字数。这里的检测总字数一般包含正文及其它可参与检测的文本模块,而重合字数则覆盖正文、引文、参考文献等所有被系统判定为相似的部分。
“去除引用文献复制比”则在前者基础上,将已被系统识别并标记为“引用”的文字从重合字数中扣除,再计算剩余重合字数与检测总字数的比值。换言之,它试图呈现的是:在剔除规范标注的引用内容之后,仍然与已有文献重合的比例。
从概念上看,总文字复制比更接近“全文相似程度”,而去除引用文献复制比更接近“排除明示引用后的相似程度”。二者并不是简单的大小关系,实际数值受引用标注识别情况和参考文献文本处理方式的影响。
两个数字为何经常不一致
报告中出现两项数值差异,通常与系统对引用内容的识别机制有关。系统能否将一段文字判定为“引用”,取决于引用标记的规范程度、上下文格式以及该部分文字在文献库中的匹配特征。一部分已标注引用来源的文字会被识别并从去引用口径中剔除,另一部分则可能因格式或匹配问题未被识别,仍保留在重合统计中。
此外,参考文献列表本身也可能成为数值差异的来源。不同系统对参考文献条目的处理策略存在差异,有的将其纳入总文字复制比的统计范围,有的则在去引用口径中予以排除。脚注、尾注、目录、致谢、声明等模块是否参与检测,同样会影响最终显示的两个百分比。
因此,当去除引用文献复制比低于总文字复制比时,只是说明系统识别出了一定数量的引用内容并加以扣除;当两项数值接近甚至相等时,也不直接等同于论文质量高低或是否存在违规,只能反映在当前检测条件下被识别为引用的文字数量有限。
报告字段的阅读顺序
在自查核对阶段,较为稳妥的阅读顺序是:先确认报告对应的检测范围和检测标准,再依次查看各项复制比数值,最后核对报告中标记为重合的具体片段。
首先查看检测范围说明。报告通常会列明本次检测包含的章节模块,或注明排除的目录、声明、致谢等内容。范围不同,同一篇论文在两次检测中的数值便可能不同。
其次对照两项复制比。总文字复制比用于观察全文层面与文献库的整体重合情况,去除引用文献复制比用于了解明示引用之外的重合程度。两者并列阅读,比单独截取任何一个数字更有参考价值。
最后应逐条查看报告中标红或标黄的具体句段。数值只是汇总结果,具体片段才能说明重合发生在引言、文献综述、研究方法还是讨论部分。对片段的核对,也有助于判断是否存在引用标注未被识别或被误判的情况。
合格口径以各校当季规定为准
需要特别注意的是,查重报告中的各项百分比只是检测系统输出的统计结果,并不直接等同于学校的合格结论。不同学校、不同学院在不同学期可能规定不同的送检口径:有的以总文字复制比为主要参考,有的以去除引用文献复制比为准,有的则设置“总文字复制比与去除引用文献复制比均须满足某一要求”的双重条件。
部分培养单位会在送检通知中明确写清“以查重报告中的哪一项数据作为审核依据”,也会说明检测范围、截止时间和命名规范等操作要求。本科生在收到报告后,应回到本院当季发布的正式通知或规章中核对口径,而不是将任一比例简单理解为全国统一划线。
对于首次查看查重报告的研究生,这一原则同样适用:先确认本院规定的统计口径,再根据自己的报告数值进行比对。报告字段属于事实呈现,最终是否进入送检下一步,取决于培养单位的公开规定和具体审核流程。


