一篇文章搞定Python操作文件与目录

所属分类: 脚本专栏 / python 阅读数: 1813
收藏 0 赞 0 分享

前言

文件和目录操作是很常见的功能,这里做个简单的总结,包括注意事项和实际的实现代码,基本日常开发都够用了

目录操作

判断目录或是文件是否存在

os.path.exists(path)

判断是否是文件或是目录

# 如果文件或是目录不存在也会返回False
os.path.isfile(path)
os.path.isdir(path)

创建/删除目录

os.mkdir(path)
os.rmdir(path)

得到当前的目录名称

os.path.split(dir_path)[1]

这个方法既简单又实用,比如我们输入一个目录路径:

os.path.split('/usr/projects/project1')[1]
# 输出
project1

# 实际上,上面的代码是分了2步走:
# 第1步:利用os.path.split方法分割路径
os.path.split('/usr/projects/project1')
# 输出
('/usr/projects', 'project1')
# 然后第2步取出第2个结果,也就是当前的目录名字

循环遍历目录

循环遍历目录有2种方式,一种是常规的递归方法,类似下面这样:

def list_file(path):
 for file in os.listdir(path):
  if os.path.isdir(os.path.join(path, file)):
   list_file(os.path.join(path, file))
  print(file)

还有一种更好的方式就是用os.walk方法,类似下面这样:

def list_file_by_walk(dir_path):
 for home, dirs, files in os.walk(dir_path):
  print(home)
  print(dirs)
  # files中是文件列表
  for file_name in files:
   print(file_name)

os.walk方法的几个参数简单介绍一下:

  • home:这个是当前遍历的目录,比如说是 /usr/projects/
  • dirs:是这个目录(home目录)下面的所有文件夹(也就是子目录)
  • files:是这个目录(home目录)下所有的文件

所以从上面的参数中可以看出,os.walk方法会逐一地遍历初始目录下面的所有目录和文件

常见的文件操作

跟上面得到目录名类似的是得到文件的后缀

os.path.splitext(file_path)

这个方法如果输入的是文件的路径,比如:

a = '/usr/projects/project1/test.txt'
os.path.splitext(a)
# 输出
('/usr/projects/project1/test', '.txt')
# 所以跟上面类似,我们可以直接拿到文件的后缀
os.path.splitext(a)[1]

文件的全路径

# 需要文件的目录路径和文件名
os.path.join(dir_name, file_name)

这个方法也很有用,因为我们在打开一个文件的时候都需要知道文件的路径

比如在上面循环遍历目录的例子中,我们可以这样打开编辑文件:

def list_file_by_walk(dir_path):
  for home, dirs, files in os.walk(dir_path):
    print(home)
    print(dirs)
    # files中是文件列表
    for file_name in files:
      # 这个file_name只是一个文件名
      print(file_name)
      # 如果我们需要打开文件进行编辑读写操作,那就需要文件的路径
      # 用os.path.join方法就可以快速得到文件路径
      file_path = os.path.join(home, file_name)

需要注意的是,不要直接用字符串相加的方式来拼接,这样子会有兼容问题,比如windows上可能路径就是错的了

读写文件

打开文件

with open(file, 'r') as f:
  for line in f.readlines():
    print line

大家只要记住上面打开文件的格式就行了,也就是这句:

with open(file_path, 打开的模式) as f
# 我们就拿到了文件对象f,可以对文件进行操作了,比如读写等

原因是文件读写是IO操作,需要及时关闭打开的文件,上述with open() as f的方式会自动帮你关闭文件的,免得自己忘记关

文件的打开模式

文件的打开模式有很多种,比如只读、只写、追加模式等等,具体可以见下图:


文件读写模式--来源于网络

模式有这么多,掌握常见的几种就可以了,其他的等用到了再去了解。需要注意以下几点:

创建文件,只需要打开一个文件即可:

# 只要这样一句就创建了一个新文件,也就是打开以后关闭文件
with open(new_file, 'w') as f:

需要特别注意的是,以w只写模式打开一个文件后会把原文件的内容清除!所以如果在遍历文件的时候,你想同时修改文件就不能简单的以w只写模式打开了。

在遍历文件的时候想同时修改文件怎么办呢?注意这里说的是修改,比如修改某一行。

修改文件的某一部分

这里举例在遍历文件的时候想修改文件,比如以上面遍历目录文件的例子:

def list_file_by_walk(dir_path):
  for home, dirs, files in os.walk(dir_path):
    print(home)
    print(dirs)
    # files中是文件列表
    for file_name in files:
      # 这个file_name只是一个文件名
      print(file_name)
      # 如果我们需要打开文件进行编辑读写操作,那就需要文件的路径
      # 用os.path.join方法就可以快速得到文件路径
      file_path = os.path.join(home, file_name)
      
      # 这个时候我想修改这个文件的内容,要怎么做呢?

需要注意的是,读写模式需要管理文件指针,比较麻烦,写读模式,则会把原先的内容都清除,所以都不适合

一种思路是我先以只读模式打开,然后遍历文件的内容保存起来,比如:

with open(file, 'r') as f:
  for line in f.readlines():
    print line
    # 这里就可以把文件的内容一行行保存起来
    # 找到需要修改的行,修改以后保存

保存以后再以只读模式打开文件,写入即可。

另一种思路是我打开原文件的同时,再打开另一个临时文件用于写入,比如这样:

with open(file, 'r') as f, open(cache_file_path, 'w') as w:
  for line in f.readlines():
    # 中间可以对f文件中的内容进行过滤或是修改
    w.write(line)

# 完了以后需要删除原文件,然后把临时文件的名字修改成原来文件的名字即可

这里就顺道引出了,删除和重命名文件的方法

os.remove(file)
os.rename(cache_file_path, file)

总结

以上就是Python文件和目录操作的常用知识点和方法总结,建议大家收藏起来,以后方便随时查看。

好了,以上就是这篇文章的全部内容了,希望本文的内容对大家的学习或者工作具有一定的参考学习价值,谢谢大家对脚本之家的支持。

更多精彩内容其他人还在看

Python中模块string.py详解

这篇文章主要介绍了Python中模块之string.py的相关资料,文中介绍的非常详细,对大家具有一定的参考价值,需要的朋友们下面来一起看看吧。
收藏 0 赞 0 分享

Python中关键字nonlocal和global的声明与解析

这篇文章主要给大家介绍了关于Python中关键字nonlocal和global的声明与解析的相关资料,文中介绍的非常详细,相信对大家具有一定的参考价值,需要的朋友们下面来一起看看吧。
收藏 0 赞 0 分享

python中pandas.DataFrame对行与列求和及添加新行与列示例

pandas是python环境下最有名的数据统计包,而DataFrame翻译为数据框,是一种数据组织方式,这篇文章主要给大家介绍了python中pandas.DataFrame对行与列求和及添加新行与列的方法,文中给出了详细的示例代码,需要的朋友可以参考借鉴,下面来一起看看吧。
收藏 0 赞 0 分享

Python中str.format()详解

本文主要给大家详细介绍的是python编程中str.format()的基本语法和高级用法,非常的详细,并附有示例,希望大家能够喜欢
收藏 0 赞 0 分享

python中pandas.DataFrame的简单操作方法(创建、索引、增添与删除)

这篇文章主要介绍了python中pandas.DataFrame的简单操作方法,其中包括创建、索引、增添与删除等的相关资料,文中介绍的非常详细,需要的朋友可以参考借鉴,下面来一起看看吧。
收藏 0 赞 0 分享

Python IDLE 错误:IDLE''s subprocess didn''t make connection 的解决方案

这篇文章主要介绍了Python IDLE 错误:IDLE's subprocess didn't make connection 的解决方案的相关资料,需要的朋友可以参考下
收藏 0 赞 0 分享

Python中类型检查的详细介绍

Python是一种非常动态的语言,函数定义中完全没有类型约束。下面这篇文章主要给大家详细介绍了Python中类型检查的相关资料,需要的朋友可以参考借鉴,下面来一起看看吧。
收藏 0 赞 0 分享

利用python程序生成word和PDF文档的方法

这篇文章主要给大家介绍了利用python程序生成word和PDF文档的方法,文中给出了详细的介绍和示例代码,相信对大家具有一定的参考价值,有需要的朋友们下面来一起看看吧。
收藏 0 赞 0 分享

python用装饰器自动注册Tornado路由详解

这篇文章主要给大家介绍了python用装饰器自动注册Tornado路由,文中给出了三个版本的解决方法,有需要的朋友可以参考借鉴,下面来一起看看吧。
收藏 0 赞 0 分享

让python 3支持mysqldb的解决方法

这篇文章主要介绍了关于让python 3支持mysqldb的解决方法,文中给出解决的示例代码,相信对大家具有一定的参考价值,有需要的朋友可以一起来看看。
收藏 0 赞 0 分享
查看更多