zoukankan      html  css  js  c++  java
  • python-29 python解压压缩包的几种方法

    这里讨论使用Python解压例如以下五种压缩文件:

    .gz .tar  .tgz .zip .rar

    简单介绍

    gz: 即gzip。通常仅仅能压缩一个文件。与tar结合起来就能够实现先打包,再压缩。

    tar: linux系统下的打包工具。仅仅打包。不压缩

    tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

    zip: 不同于gzip。尽管使用相似的算法,能够打包压缩多个文件。只是分别压缩文件。压缩率低于tar。

    rar:打包压缩文件。最初用于DOS,基于window操作系统。

    压缩率比zip高,但速度慢。随机訪问的速度也慢。

    gz

     因为gz一般仅仅压缩一个文件,全部常与其它打包工具一起工作。比方能够先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

    解压gz,事实上就是读出当中的单一文件,Python方法例如以下:

    import gzip
    import os
    def un_gz(file_name):
        """ungz zip file"""
        f_name = file_name.replace(".gz", "")
        #获取文件的名称,去掉
        g_file = gzip.GzipFile(file_name)
        #创建gzip对象
        open(f_name, "w+").write(g_file.read())
        #gzip对象用read()打开后,写入open()建立的文件里。
        g_file.close()
        #关闭gzip对象

    tar

    XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

    *注:tgz与tar.gz是同样的格式,老版本号DOS扩展名最多三个字符,故用tgz表示。

    因为这里有多个文件,我们先读取全部文件名称。然后解压。例如以下:

    import tarfile
    def un_tar(file_name):
           untar zip file"""
        tar = tarfile.open(file_name)
        names = tar.getnames()
        if os.path.isdir(file_name + "_files"):
            pass
        else:
            os.mkdir(file_name + "_files")
        #因为解压后是很多文件,预先建立同名目录
        for name in names:
            tar.extract(name, file_name + "_files/")
        tar.close()


    *注:tgz文件与tar文件同样的解压方法。

    zip

    与tar类似,先读取多个文件名称,然后解压。例如以下:

    import zipfile
    def un_zip(file_name):
        """unzip zip file"""
        zip_file = zipfile.ZipFile(file_name)
        if os.path.isdir(file_name + "_files"):
            pass
        else:
            os.mkdir(file_name + "_files")
        for names in zip_file.namelist():
            zip_file.extract(names,file_name + "_files/")
        zip_file.close()

    rar

    由于rar通常为window下使用,须要额外的Python包rarfile。

    可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

    解压到Python安装文件夹的/Scripts/文件夹下,在当前窗体打开命令行,

    输入Python setup.py install

    安装完毕。

    import rarfile
    import os
    def un_rar(file_name):
        """unrar zip file"""
        rar = rarfile.RarFile(file_name)
        if os.path.isdir(file_name + "_files"):
            pass
        else:
            os.mkdir(file_name + "_files")
        os.chdir(file_name + "_files"):
        rar.extractall()
        rar.close()

    tar打包
    在写打包代码的过程中,使用tar.add()添加文件时,会把文件本身的路径也加进去,加上arcname就能依据自己的命名规则将文件添加tar包
    打包代码:
    1. #!/usr/bin/env /usr/local/bin/python  
    2.  # encoding: utf-8  
    3.  import tarfile  
    4.  import os  
    5.  import time  
    6.   
    7.  start = time.time()  
    8.  tar=tarfile.open('/path/to/your.tar,'w')  
    9.  for root,dir,files in os.walk('/path/to/dir/'):  
    10.          for file in files:  
    11.                  fullpath=os.path.join(root,file)  
    12.                  tar.add(fullpath,arcname=file)  
    13.  tar.close()  
    14.  print time.time()-start  
     
    tar解包
    tar解包也能够依据不同压缩格式来解压。
    1. #!/usr/bin/env /usr/local/bin/python  
    2.  # encoding: utf-8  
    3.  import tarfile  
    4.  import time  
    5.   
    6.  start = time.time()  
    7.  t = tarfile.open("/path/to/your.tar", "r:")  
    8.  t.extractall(path = '/path/to/extractdir/')  
    9.  t.close()  
    10.  print time.time()-start  
     
    上面的代码是解压全部的,也能够挨个起做不同的处理,但要假设tar包内文件过多,小心内存哦~
    1. tar = tarfile.open(filename, 'r:gz')  
    2. for tar_info in tar:  
    3.     file = tar.extractfile(tar_info)  
    4.     do_something_with(file)  
  • 相关阅读:
    Mac 修改hosts
    MTK平台系统稳定性分析
    由MTK平台 mtkfb 设备注册疑问引发的知识延伸--ARM Device Tree
    mtk display 架构
    【6572】关于mtk平台display模块的学习探讨
    如何用Bugzilla系统管理产品研发过中相关需求和bug
    Bugzilla 系统企业应用案例
    MT6753平台一项目不同手机最低亮度存偏差问题分析过程
    嵌入式驱动实习生试题(答案)
    嵌入式驱动实习生试题
  • 原文地址:https://www.cnblogs.com/Zhouzg-2018/p/10263437.html
Copyright © 2011-2022 走看看