其实无论windows还是Linux,简单地去实现两个两个文件夹的同步只需系统自带的复制命令加参数就可以了。
WINDOWS:
xcopy 源文件夹\* 目标文件夹 /s /e /y
Linux:
cp -r 源文件夹/* 目标文件夹
这里使用python来实现这些基本功能,并增加一些去重之类的增强功能。
1、复制源文件夹中文件至目标文件夹
要想同步两个文件夹中的数据,基本思路首先需要遍历源文件夹中的信息,将源文件夹中的文件复制到目标文件夹。
遍历文件夹采用os中的listdir函数就可以了。
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' for filename in os.listdir(path_s): filename_s = path_s+os.sep+filename print '[*] Source :',filename_s filename_t = path_t+os.sep+filename print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read())
但是很明显这里没有考虑源文件夹中还会存在文件夹甚至多重文件夹的情况。
2、源文件夹中存在多重文件夹
一个简单的思路就是:在遍历源文件夹内的文件时,先判定当前文件这是文件还是文件夹。如果当前文件是文件夹的话,开始遍历此文件夹内的文件,如果里面还有文件夹,遍历这个文件夹,依次类推。利用递归的方法,代码如下:
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' def copy_file(paths,patht): for filename in os.listdir(paths): filename_s = paths+os.sep+filename filename_t = patht+os.sep+filename if os.path.isdir(filename_s): if not os.path.exists(filename_t): os.mkdir(filename_t) #在目标文件夹中创建对应的文件夹 copy_file(filename_s,filename_t) # 递归 else: print '[*] Source :',filename_s print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read()) copy_file(path_s,path_t)
目前,简单的文件夹复制功能已经实现了。
3、目标文件夹中已有文件不再复制
一个简单的方法就是在目标文件夹中复制文件之前先利用函数“os.path.exists”判定这个文件是否存在。
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' def copy_file(paths,patht): for filename in os.listdir(paths): filename_s = paths+os.sep+filename filename_t = patht+os.sep+filename if os.path.isdir(filename_s): if not os.path.exists(filename_t): os.mkdir(filename_t) copy_file(filename_s,filename_t) else: if os.path.exists(filename_t): print '[*] "%s" already exists! ' % filename_t else: print '[*] Source :',filename_s print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read()) copy_file(path_s,path_t)
这个办法避免了一部分已有文件的重复复制操作,减少了部分不必要的读写操作,但是却无法消除内容相同但名称、路径不同的重复文件。
4、利用MD5判定重复文件
目前判定两个文件是否相同,除了按字节逐个对比这个笨方法外,简单常用的办法就是利用MD5和CRC校验,或是按一定规律挑取文件的指定位置的数据块就行对比。
这次利用文件的MD5值,将目标文件夹中已有文件的MD5值保存到列表或字典中,每在源文件夹中读取一个文件就判定该文件的MD5值是否已经存在于MD5列表,没有的话再进行复制操作,并将该文件的MD5值写入列表。
import os import hashlib path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' list_file = {} def create_file_list(path): for name in os.listdir(path): filename = path+os.sep+name if os.path.isdir(filename): create_file_list(filename) else: with open(filename,'rb') as f: md5 = hashlib.md5(f.read()).hexdigest() if md5 not in list_file: list_file[md5] = 1 def copy_file(paths,patht): for filename in os.listdir(paths): filename_s = paths+os.sep+filename filename_t = patht+os.sep+filename if os.path.isdir(filename_s): if not os.path.exists(filename_t): os.mkdir(filename_t) copy_file(filename_s,filename_t) else: if os.path.exists(filename_t): print '[*] "%s" already exists! ' % filename_t else: with open(filename_s,'rb') as f_s: data = f_s.read() file_md5 = hashlib.md5(data).hexdigest() if file_md5 not in list_file: list_file[file_md5] = 1 print '[*] Source :',filename_s print '[*] Target :',filename_t with open(filename_t,'wb') as f_t: f_t.write(data) else: print '[*] "%s"\'s MD5 already exists! ' % filename_t create_file_list(path_t) copy_file(path_s,path_t)
如下图,运行后内容相同的几个文件,只有第一次读取到的时候才写入目标文件夹,其他路径下的文件并没有复制到目标文件夹。
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
免责声明:本站文章均来自网站采集或用户投稿,网站不提供任何软件下载或自行开发的软件! 如有用户或公司发现本站内容信息存在侵权行为,请邮件告知! 858582#qq.com
稳了!魔兽国服回归的3条重磅消息!官宣时间再确认!
昨天有一位朋友在大神群里分享,自己亚服账号被封号之后居然弹出了国服的封号信息对话框。
这里面让他访问的是一个国服的战网网址,com.cn和后面的zh都非常明白地表明这就是国服战网。
而他在复制这个网址并且进行登录之后,确实是网易的网址,也就是我们熟悉的停服之后国服发布的暴雪游戏产品运营到期开放退款的说明。这是一件比较奇怪的事情,因为以前都没有出现这样的情况,现在突然提示跳转到国服战网的网址,是不是说明了简体中文客户端已经开始进行更新了呢?
更新日志
- 雨林唱片《赏》新曲+精选集SACD版[ISO][2.3G]
- 罗大佑与OK男女合唱团.1995-再会吧!素兰【音乐工厂】【WAV+CUE】
- 草蜢.1993-宝贝对不起(国)【宝丽金】【WAV+CUE】
- 杨培安.2009-抒·情(EP)【擎天娱乐】【WAV+CUE】
- 周慧敏《EndlessDream》[WAV+CUE]
- 彭芳《纯色角3》2007[WAV+CUE]
- 江志丰2008-今生为你[豪记][WAV+CUE]
- 罗大佑1994《恋曲2000》音乐工厂[WAV+CUE][1G]
- 群星《一首歌一个故事》赵英俊某些作品重唱企划[FLAC分轨][1G]
- 群星《网易云英文歌曲播放量TOP100》[MP3][1G]
- 方大同.2024-梦想家TheDreamer【赋音乐】【FLAC分轨】
- 李慧珍.2007-爱死了【华谊兄弟】【WAV+CUE】
- 王大文.2019-国际太空站【环球】【FLAC分轨】
- 群星《2022超好听的十倍音质网络歌曲(163)》U盘音乐[WAV分轨][1.1G]
- 童丽《啼笑姻缘》头版限量编号24K金碟[低速原抓WAV+CUE][1.1G]