内容重复率检测
检测文本内部的重复句子、重复行与高频词组,计算整体重复率并高亮定位。本工具做的是「自我查重」,不与互联网内容比对,全程浏览器本地完成。
0.6~0.9 之间:调低会识别更多「部分相似」的句子,调高只匹配几乎相同的句子
粘贴文本并点击「开始检测」,检测报告将显示在这里。
本工具检测的是文本内部的自我重复(相同的句子、相似的表述反复出现),不会与互联网或数据库中的其他文献比对,结果不能替代学术查重系统。
重复率是怎么计算的
检测从三个维度进行:重复句——按标点切分句子后,完全相同的句子直接判重,长度接近的句子用字符二元组(bigram)相似度判断,能识别「换了几个词」的表述;重复行——完全相同的非空行;整体重复率——被判定为重复的字符量占全文字符的比例。
相似句阈值默认 0.8:两句相似度达到 80% 即算重复。调低到 0.6 能抓到更多改写句(误报也会增多),调高到 0.9 则只匹配几乎一致的句子。高亮预览会直接在原文中标出所有重复位置,方便回改。
这个工具适合:检查 AI 生成或模板化文案中的车轱辘话、发现写作时无意识的句子重复、清理名单或数据文件中的重复行。它不能替代学术查重——后者比对你的文章与海量文献库,两者解决的是不同问题。
使用步骤
- 把要检测的文本粘贴到上方输入框。
- 按需调整相似句阈值,点击「开始检测」。
- 查看重复率与重复清单,在原文高亮中定位并修改重复表述。
常见问题
这个工具能替代论文查重吗?
不能。学术查重比对你的文章与文献数据库中他人的作品;本工具只检测你自己文本内部的重复内容(自我重复)。两者互补:先用本工具消除行文重复,再交给学术系统查外部重复。
重复率多少算正常?
没有绝对标准。普通行文通常在 5% 以下;清单类、说明类文本天然重复较多;如果重复率超过 20%,建议检查高亮部分是否存在大段车轱辘话。
相似句是怎么判定的?
两句按字符二元组计算 Jaccard 相似度,超过阈值(默认 80%)即判定为重复。它对语序调整、个别词替换不敏感,适合发现换词复读。
文本会被上传吗?
不会。切句、相似度计算与高亮全部在浏览器本地完成,检测过程没有任何网络请求,关闭页面后数据即消失。