python解压压缩包的几种方法

python解压压缩包的几种方法

.gz .tar  .tgz .zip .rar

简介

gz: 即gzip,通常只能压缩一个文件。与tar结合起来就可以实现先打包,再压缩。

tar: linux系统下的打包工具,只打包,不压缩

tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,压缩率低于tar。

rar:打包压缩文件,最初用于DOS,基于window操作系统。压缩率比zip高,但速度慢,随机访问的速度也慢。

关于zip于rar之间的各种比较,可见:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

由于gz一般只压缩一个文件,所有常与其他打包工具一起工作。比如可以先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

解压gz,其实就是读出其中的单一文件,Python方法如下:

[python] view plain copy

  1. import gzip
  2. import os
  3. def un_gz(file_name):
  4. """ungz zip file"""
  5. f_name = file_name.replace(".gz", "")
  6. #获取文件的名称,去掉
  7. g_file = gzip.GzipFile(file_name)
  8. #创建gzip对象
  9. open(f_name, "w+").write(g_file.read())
  10. #gzip对象用read()打开后,写入open()建立的文件中。
  11. g_file.close()
  12. #关闭gzip对象

tar

XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

*注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。

由于这里有多个文件,我们先读取所有文件名,然后解压,如下:

[python] view plain copy

  1. import tarfile
  2. def un_tar(file_name):
  3. untar zip file"""
  4. tar = tarfile.open(file_name)
  5. names = tar.getnames()
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. #由于解压后是许多文件,预先建立同名文件夹
  11. for name in names:
  12. tar.extract(name, file_name + "_files/")
  13. tar.close()

*注:tgz文件与tar文件相同的解压方法。

zip

与tar类似,先读取多个文件名,然后解压,如下:

[python] view plain copy

  1. import zipfile
  2. def un_zip(file_name):
  3. """unzip zip file"""
  4. zip_file = zipfile.ZipFile(file_name)
  5. if os.path.isdir(file_name + "_files"):
  6. pass
  7. else:
  8. os.mkdir(file_name + "_files")
  9. for names in zip_file.namelist():
  10. zip_file.extract(names,file_name + "_files/")
  11. zip_file.close()

rar

因为rar通常为window下使用,需要额外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,

输入Python setup.py install

安装完成。

[python] view plain copy

  1. import rarfile
  2. import os
  3. def un_rar(file_name):
  4. """unrar zip file"""
  5. rar = rarfile.RarFile(file_name)
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. os.chdir(file_name + "_files"):
  11. rar.extractall()
  12. rar.close()

tar打包

在写打包代码的过程中,使用tar.add()增加文件时,会把文件本身的路径也加进去,加上arcname就能根据自己的命名规则将文件加入tar包

打包代码:

  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import os
  5. import time
  6. start = time.time()
  7. tar=tarfile.open(‘/path/to/your.tar,‘w‘)
  8. for root,dir,files in os.walk(‘/path/to/dir/‘):
  9. for file in files:
  10. fullpath=os.path.join(root,file)
  11. tar.add(fullpath,arcname=file)
  12. tar.close()
  13. print time.time()-start

在打包的过程中可以设置压缩规则,如想要以gz压缩的格式打包

tar=tarfile.open(‘/path/to/your.tar.gz‘,‘w:gz‘)

其他格式如下表:

tarfile.open的mode有很多种:

mode action

‘r‘ or ‘r:*‘ Open for reading with transparent compression (recommended).
‘r:‘ Open for reading exclusively without compression.
‘r:gz‘ Open for reading with gzip compression.
‘r:bz2‘ Open for reading with bzip2 compression.
‘a‘ or ‘a:‘ Open for appending with no compression. The file is created if it does not exist.
‘w‘ or ‘w:‘ Open for uncompressed writing.
‘w:gz‘ Open for gzip compressed writing.
‘w:bz2‘ Open for bzip2 compressed writing.

tar解包

tar解包也可以根据不同压缩格式来解压。

  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import time
  5. start = time.time()
  6. t = tarfile.open("/path/to/your.tar", "r:")
  7. t.extractall(path = ‘/path/to/extractdir/‘)
  8. t.close()
  9. print time.time()-start

上面的代码是解压所有的,也可以挨个起做不同的处理,但要如果tar包内文件过多,小心内存哦~

  1. tar = tarfile.open(filename, ‘r:gz‘)
  2. for tar_info in tar:
  3. file = tar.extractfile(tar_info)
  4. do_something_with(file)

原文地址:https://www.cnblogs.com/xuaijun/p/9359443.html

时间: 2024-12-08 19:54:33

python解压压缩包的几种方法的相关文章

python-29 python解压压缩包的几种方法

这里讨论使用Python解压例如以下五种压缩文件: .gz .tar  .tgz .zip .rar 简单介绍 gz: 即gzip.通常仅仅能压缩一个文件.与tar结合起来就能够实现先打包,再压缩. tar: linux系统下的打包工具.仅仅打包.不压缩 tgz:即tar.gz.先用tar打包,然后再用gz压缩得到的文件 zip: 不同于gzip.尽管使用相似的算法,能够打包压缩多个文件.只是分别压缩文件.压缩率低于tar. rar:打包压缩文件.最初用于DOS,基于window操作系统. 压缩

python 解压 压缩包

转 http://m.blog.csdn.net/blog/wice110956/26597179# 这里讨论使用Python解压如下五种压缩文件: .gz .tar  .tgz .zip .rar 简介 gz: 即gzip,通常只能压缩一个文件.与tar结合起来就可以实现先打包,再压缩. tar: linux系统下的打包工具,只打包,不压缩 tgz:即tar.gz.先用tar打包,然后再用gz压缩得到的文件 zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,

python 解压 zip 文件

python 解压压缩包 使用 python 的 zipfile 模块 对同一目录下的所有 zip 文件解压,也可以指定解压文件名 import os import sys import zipfile def unzip(filename: str): try: file = zipfile.ZipFile(filename) dirname = filename.replace('.zip', '') # 如果存在与压缩包同名文件夹 提示信息并跳过 if os.path.exists(dir

Python安装第三方库的4种方法

Python安装第三方库的4种方法 1.使用pip 大多数库都可以通过pip安装,安装方法为,在命令行窗口输入:pip install libName libName     -   为库名 某些库通过pip安装不了,可能是因为没有打包上传到pypi中,可以下载安装包之后离线安装,方法是:pip install libPath libPath  -   为本地安装包地址,这些安装包一般以whl为后缀名.表示python扩展包的windows环境下的二进制文件.有一个专门下载这种文件的地方http

Python爬取网页的三种方法

# Python爬取网页的三种方法之一:  使用urllib或者urllib2模块的getparam方法 import urllib fopen1 = urllib.urlopen('http://www.baidu.com').info() fopen2 = urllib2.urlopen('http://www.sina.com').info() print fopen1.getparam('charset') print fopen2.getparam('charset') #----有些

「python」: arp脚本的两种方法

「python」: arp脚本的两种方法 第一种是使用arping工具: #!/usr/bin/env python import subprocess import sys import re def arping(ipaddress = "192.168.1.1"): p = subprocess.Popen("/usr/sbin/arping -c 2 %s" % ipaddress, shell = True, stdout = subprocess.PIP

python中执行shell的两种方法总结

这篇文章主要介绍了python中执行shell的两种方法,有两种方法可以在Python中执行SHELL程序,方法一是使用Python的commands包,方法二则是使用subprocess包,这两个包均是Python现有的内置模块.需要的朋友可以参考借鉴,下面来一起看看吧. 一.使用python内置commands模块执行shell commands对Python的os.popen()进行了封装,使用SHELL命令字符串作为其参数,返回命令的结果数据以及命令执行的状态: 该命令目前已经废弃,被s

用Python进行时间序列预测的7种方法

数据准备 数据集(JetRail高铁的乘客数量)下载. 假设要解决一个时序问题:根据过往两年的数据(2012 年 8 月至 2014 年 8月),需要用这些数据预测接下来 7 个月的乘客数量. import pandas as pd import numpy as np import matplotlib.pyplot as plt df = pd.read_csv('train.csv') df.head() df.shape 依照上面的代码,我们获得了 2012-2014 年两年每个小时的乘

[教程] wdcp文件管理器里不能删除或移动解压后的文件解决方法

问题:在本地上传压缩包到服务器之后,在wdcp文件管理器里解压,解压之后想把文件移动到其他目录,填写好移动的目标目录之后点移动,显示移动成功,但到目标目录却发现没有自己所移动的文件,文件不知道消失到哪里去了:再看原本解压后的文件夹里也没有文件. 解决方法:看看是不是自己的压缩前的文件夹里有文件名或文件夹名包含中文字符,把他改成英文后再压缩上传,解压之后移动就没问题了:同样,删除不了的文件也可能是你文件名里包含了中文,甚至上传解压之后的文件名已经不是正常中文了,而是乱码! 转自:http://ww