文件批量提取与过滤工具在运维场景中的应用
在日常运维和文件管理工作中,经常需要从复杂的目录结构中提取特定文件。这篇记录【批量提取文件夹内文件工具】在几个实际场景中的应用。
场景一:从多层目录中提取日志文件
需求:服务器上的日志按日期分目录存放(logs/2024/01/app.log),需要把某个时间段内的所有日志文件提取到一个目录里分析。
配置:
- 主文件夹:logs目录
- 遍历子目录:开
- 文件类型:log
- 日期过滤:开,设置起止日期
- 操作模式:复制
结果:只提取了指定日期范围内的日志文件,其他时间段的不受影响。
场景二:清理临时文件
需求:项目目录里散落着大量临时文件(.tmp、.bak、.temp),需要把它们集中到一个目录里确认后删除。
配置:
- 主文件夹:项目根目录
- 遍历子目录:开
- 文件类型:tmp|bak|temp
- 操作模式:移动(确认后可以直接删除目标目录)
注意:移动模式会删除原文件,建议先用复制模式确认结果正确后再用移动模式。
场景三:按文件大小筛选
需求:找出某个目录下所有大于100MB的文件,评估是否需要清理。
配置:
- 主文件夹:目标目录
- 遍历子目录:开
- 文件类型:不填(所有文件)
- 最小大小:0KB
- 最大大小:0MB(不限制上限)
等等,这个需求应该反过来——找大文件应该设最小大小。
配置:
- 最小大小:102400KB(100MB)
- 最大大小:0(不限制)
过滤参数说明
| 参数 | 说明 | 示例 |
|---|---|---|
| 文件类型 | 用竖线分隔多个扩展名 | jpg|png|gif |
| 最小大小(KB) | 0表示不限制 | 100 = 过滤掉小于100KB的文件 |
| 最大大小(MB) | 0表示不限制 | 500 = 过滤掉大于500MB的文件 |
| 日期过滤 | 按文件修改日期筛选 | 2024-01-01 到 2024-01-31 |
保持原路径结构 vs 平铺
两种输出方式适用不同场景:
保持原路径结构:提取后的文件保留原来的目录层级,适合需要保留文件组织结构的场景。
平铺(不勾选):所有文件都放在目标目录的根目录下,适合需要把文件集中到一起处理的场景。重名文件自动加数字后缀。
注意事项
- 移动模式会删除原文件,操作前建议先用复制模式验证结果
- 源目录和目标目录不能相同
- 如果目标目录是源目录的子目录,工具会弹出警告(可能导致重复处理)
- 重名文件自动加数字后缀,不会覆盖已有文件
