同名、同大小、看起来相似,都不是精确重复的充分证据
两个 final.pdf 可能是不同版本;final-copy.pdf 也可能与原文件字节完全相同。因此仅按名称会同时产生误报和漏报。
图片经过压缩、旋转或重新编码后可能肉眼相似但字节已经不同。当前 FileNest 只找精确内容副本,不冒充相似照片检测。
- 同名 ≠ 内容相同。
- 同大小 ≠ 内容相同。
- 视觉相似 ≠ 字节相同。
- 精确重复 = 候选内容 SHA-256 完全一致。
先用字节大小预筛,再读取候选内容
字节完全相同的两个文件一定具有相同大小,因此大小不同可以先直接排除。这样不需要为了形式对每个唯一大小文件都读取内容。
只有同大小候选才继续计算 SHA-256。当前工作区在浏览器本地完成内容比较,不需要为了重复检测把工作文件内容上传到 FileNest。
停止或无法读取时,部分结果必须明确标出来
如果扫描被停止,或候选文件无法读取,结果不能被描述成完整覆盖。当前流程会保留 partial / stopped / unreadable 边界,CSV 报告也记录扫描状态和候选覆盖。
这可以避免使用者把“没有显示更多重复”误解为“所有候选都已经成功检查”。
确认重复以后,不自动替你删除
即使内容完全一样,不同路径和文件名仍可能被项目、脚本或人工流程依赖。FileNest 当前只报告重复组和证据,不自动删除、移动或覆盖文件。
清理完成后,如果剩余文件还需要统一项目名、日期、编号或客户指定名称,再进入 Batch Renamer。偶发基础改名继续免费,长期正则、CSV 映射或保存模板才属于 Pro 的重复工作价值。
当前浏览器边界
当前重复检测一次最多接受 500 个明确选择的文件。这个边界用于浏览器稳定性,不是转换额度;重复检测本身保持免费。
浏览器只能检查你明确选择并授权给页面的文件,这不等于网页可以扫描整块硬盘。