内容重复率检测

检测文本内部的重复句子、重复行与高频词组,计算整体重复率并高亮定位。本工具做的是「自我查重」,不与互联网内容比对,全程浏览器本地完成。

输入待检测文本

0.6~0.9 之间:调低会识别更多「部分相似」的句子,调高只匹配几乎相同的句子

检测结果

—整体重复率
0重复句 0 组
0重复行 0 组

粘贴文本并点击「开始检测」,检测报告将显示在这里。

本工具检测的是文本内部的自我重复(相同的句子、相似的表述反复出现),不会与互联网或数据库中的其他文献比对,结果不能替代学术查重系统。

重复率是怎么计算的

检测从三个维度进行:重复句——按标点切分句子后,完全相同的句子直接判重,长度接近的句子用字符二元组(bigram)相似度判断,能识别「换了几个词」的表述;重复行——完全相同的非空行;整体重复率——被判定为重复的字符量占全文字符的比例。

相似句阈值默认 0.8:两句相似度达到 80% 即算重复。调低到 0.6 能抓到更多改写句(误报也会增多),调高到 0.9 则只匹配几乎一致的句子。高亮预览会直接在原文中标出所有重复位置,方便回改。

这个工具适合:检查 AI 生成或模板化文案中的车轱辘话、发现写作时无意识的句子重复、清理名单或数据文件中的重复行。它不能替代学术查重——后者比对你的文章与海量文献库,两者解决的是不同问题。

使用步骤

  1. 把要检测的文本粘贴到上方输入框。
  2. 按需调整相似句阈值,点击「开始检测」。
  3. 查看重复率与重复清单,在原文高亮中定位并修改重复表述。

常见问题

这个工具能替代论文查重吗?

不能。学术查重比对你的文章与文献数据库中他人的作品;本工具只检测你自己文本内部的重复内容(自我重复)。两者互补:先用本工具消除行文重复,再交给学术系统查外部重复。

重复率多少算正常?

没有绝对标准。普通行文通常在 5% 以下;清单类、说明类文本天然重复较多;如果重复率超过 20%,建议检查高亮部分是否存在大段车轱辘话。

相似句是怎么判定的?

两句按字符二元组计算 Jaccard 相似度,超过阈值(默认 80%)即判定为重复。它对语序调整、个别词替换不敏感,适合发现换词复读。

文本会被上传吗?

不会。切句、相似度计算与高亮全部在浏览器本地完成,检测过程没有任何网络请求,关闭页面后数据即消失。