1. 程式人生 > >python解壓壓縮包的幾種方法

python解壓壓縮包的幾種方法

打包工具 ESS rfi keyword 寫入 解壓 os.path gzip action

python解壓壓縮包的幾種方法

.gz .tar .tgz .zip .rar

簡介

gz: 即gzip,通常只能壓縮一個文件。與tar結合起來就可以實現先打包,再壓縮。

tar: linux系統下的打包工具,只打包,不壓縮

tgz:即tar.gz。先用tar打包,然後再用gz壓縮得到的文件

zip: 不同於gzip,雖然使用相似的算法,可以打包壓縮多個文件,不過分別壓縮文件,壓縮率低於tar。

rar:打包壓縮文件,最初用於DOS,基於window操作系統。壓縮率比zip高,但速度慢,隨機訪問的速度也慢。

關於zip於rar之間的各種比較,可見:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

由於gz一般只壓縮一個文件,所有常與其他打包工具一起工作。比如可以先用tar打包為XXX.tar,然後在壓縮為XXX.tar.gz

解壓gz,其實就是讀出其中的單一文件,Python方法如下:

[python] view plain copy
  1. import gzip
  2. import os
  3. def un_gz(file_name):
  4. """ungz zip file"""
  5. f_name = file_name.replace(".gz", "")
  6. #獲取文件的名稱,去掉
  7. g_file = gzip.GzipFile(file_name)
  8. #創建gzip對象
  9. open(f_name, "w+").write(g_file.read())
  10. #gzip對象用read()打開後,寫入open()建立的文件中。
  11. g_file.close()
  12. #關閉gzip對象

tar

XXX.tar.gz解壓後得到XXX.tar,還要進一步解壓出來。

*註:tgz與tar.gz是相同的格式,老版本DOS擴展名最多三個字符,故用tgz表示。

由於這裏有多個文件,我們先讀取所有文件名,然後解壓,如下:

[python] view plain copy
  1. import tarfile
  2. def un_tar(file_name):
  3. untar zip file"""
  4. tar = tarfile.open(file_name)
  5. names = tar.getnames()
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. #由於解壓後是許多文件,預先建立同名文件夾
  11. for name in names:
  12. tar.extract(name, file_name + "_files/")
  13. tar.close()

*註:tgz文件與tar文件相同的解壓方法。

zip

與tar類似,先讀取多個文件名,然後解壓,如下:

[python] view plain copy
  1. import zipfile
  2. def un_zip(file_name):
  3. """unzip zip file"""
  4. zip_file = zipfile.ZipFile(file_name)
  5. if os.path.isdir(file_name + "_files"):
  6. pass
  7. else:
  8. os.mkdir(file_name + "_files")
  9. for names in zip_file.namelist():
  10. zip_file.extract(names,file_name + "_files/")
  11. zip_file.close()

rar

因為rar通常為window下使用,需要額外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解壓到Python安裝目錄的/Scripts/目錄下,在當前窗口打開命令行,

輸入Python setup.py install

安裝完成。

[python] view plain copy
  1. import rarfile
  2. import os
  3. def un_rar(file_name):
  4. """unrar zip file"""
  5. rar = rarfile.RarFile(file_name)
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. os.chdir(file_name + "_files"):
  11. rar.extractall()
  12. rar.close()


tar打包 在寫打包代碼的過程中,使用tar.add()增加文件時,會把文件本身的路徑也加進去,加上arcname就能根據自己的命名規則將文件加入tar包 打包代碼:
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import os
  5. import time
  6. start = time.time()
  7. tar=tarfile.open(‘/path/to/your.tar,‘w‘)
  8. for root,dir,files in os.walk(‘/path/to/dir/‘):
  9. for file in files:
  10. fullpath=os.path.join(root,file)
  11. tar.add(fullpath,arcname=file)
  12. tar.close()
  13. print time.time()-start

在打包的過程中可以設置壓縮規則,如想要以gz壓縮的格式打包 tar=tarfile.open(‘/path/to/your.tar.gz‘,‘w:gz‘) 其他格式如下表: tarfile.open的mode有很多種: mode action
‘r‘ or ‘r:*‘ Open for reading with transparent compression (recommended).
‘r:‘ Open for reading exclusively without compression.
‘r:gz‘ Open for reading with gzip compression.
‘r:bz2‘ Open for reading with bzip2 compression.
‘a‘ or ‘a:‘ Open for appending with no compression. The file is created if it does not exist.
‘w‘ or ‘w:‘ Open for uncompressed writing.
‘w:gz‘ Open for gzip compressed writing.
‘w:bz2‘ Open for bzip2 compressed writing.
tar解包 tar解包也可以根據不同壓縮格式來解壓。
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import time
  5. start = time.time()
  6. t = tarfile.open("/path/to/your.tar", "r:")
  7. t.extractall(path = ‘/path/to/extractdir/‘)
  8. t.close()
  9. print time.time()-start
上面的代碼是解壓所有的,也可以挨個起做不同的處理,但要如果tar包內文件過多,小心內存哦~
  1. tar = tarfile.open(filename, ‘r:gz‘)
  2. for tar_info in tar:
  3. file = tar.extractfile(tar_info)
  4. do_something_with(file)

python解壓壓縮包的幾種方法