Python文件的读写及文件字符编码设置方法详解-Python教程-PHP中文网

首页

后端开发

Python教程

Python文件的读写及文件字符编码设置方法详解

巴扎黑

Aug 18, 2017 pm 01:56 PM

python字符文件

文件读写操作在各种编程语言中都是比较重要的部分，也是很常用的部分，今天就来详细说一下python对文件的读写操作，以及需要注意的点。

一. python打开文件

代码如下：

f = open("d:\test.txt", "w")

说明：

第一个参数是文件名称，包括路径；

第二个参数是打开的模式mode

‘r’：只读（缺省。如果文件不存在，则抛出错误）

‘w’：只写（如果文件不存在，则自动创建文件）

‘a’：附加到文件末尾

‘r+’：读写

如果需要以二进制方式打开文件，需要在mode后面加上字符”b”，比如”rb””wb”等

二、python读取文件内容f.read([size])

参数size表示读取的数量，可以省略。如果省略size参数，则表示读取文件所有内容。

f.readline()读取文件一行的内容 f.readlines()读取所有的行到数组里面[line1,line2,…lineN]。

f = open(&#39;./pythontab.txt&#39;, &#39;r&#39;)
content = f.read()
print content

在避免将所有文件内容加载到内存中，这种方法常常使用，便于提高效率。

三、python写入文件f.write(string)

将一个字符串写入文件

f = open(&#39;./pythontab.txt&#39;, &#39;r+&#39;)
f.write(&#39;Hello, Pythontab.com&#39;)
f.close()

注意：如果写入结束，可以在字符串后面加上”\n”来表示换行，最后必须用f.close()关闭文件。否则可能会出现异常，特别是在高并发的情况下。

四、文件中的内容定位

f.read()读取之后，文件指针到达文件的末尾，如果再来一次f.read()将会发现读取的是空内容，如果想再次读取全部内容，必须将定位指针移动到文件开始：

f.seek(0)

这个函数的格式如下（单位是bytes）：f.seek(offset, from_what) from_what表示开始读取的位置，offset表示从from_what再移动一定量的距离，比如f.seek(10, 3)表示定位到第三个字符并再后移10个字符。

from_what值为0时表示文件的开始，它也可以省略，缺省是0即文件开头。下面给出一个完整的例子：

f = open(&#39;./pythontab.txt&#39;, &#39;r+&#39;)
f.write(&#39;Hello, Pythontab.com&#39;)
f.seek(5)     # 定位到第6个byte
f.read(1)        
f.seek (-3, 2) #定位到第2个字符并再向前移动3个字符
f.read(1)

五、关闭文件

关闭文件释放资源文件操作完毕，一定要记得关闭文件f.close()，可以释放资源供其他程序使只是ASCII或者gbk编码格式的的文件读写，比较简单，读写如下：

# coding=gbk
f = open(&#39;./pythontab.txt&#39;,&#39;r&#39;) # r 指示文件打开模式，即只读
s1 = f.read()
s2 = f.readline()
s3 = f.readlines() #读出所有内容
f.close()
f = open(&#39;./pythontab.txt&#39;,&#39;w&#39;) # w 写文件
11 f.write(s1)
12 f.writelines(s2) # 没有writeline
13 f.close()

六. f.writelines不会输出换行符

python unicode文件读写：

# coding=gbk
import codecs
f = codecs.open(&#39;./pythontab.txt&#39;,&#39;a&#39;,&#39;utf-8&#39;)
f.write(u&#39;中文&#39;)
s = &#39;中文&#39;
f.write(s.decode(&#39;gbk&#39;))
f.close()
f = codecs.open(&#39;./pythontab.txt&#39;,&#39;r&#39;,&#39;utf-8&#39;)
s = f.readlines()
f.close()
for line in s:
    print line.encode(&#39;gbk&#39;)

七. python代码文件的编码

py文件默认是ASCII编码，中文在显示时会做一个ASCII到系统默认编码的转换，这时就会出错：SyntaxError: Non-ASCII character。需要在代码文件的第一行或第二行添加编码指示：

# coding=utf-8 ##以utf-8编码储存中文字符

print ‘中文’像上面那样直接输入的字符串是按照代码文件的编码来处理的，如果用unicode编码，有以下2种方式：

s1 = u’中文’ #u表示用unicode编码方式储存信息

s2 = unicode(‘中文’,’gbk’)

unicode是一个内置函数，第二个参数指示源字符串的编码格式。

decode是任何字符串具有的方法，将字符串转换成unicode格式，参数指示源字符串的编码格式。

encode也是任何字符串具有的方法，将字符串转换成参数指定的格式。

python字符串的编码

用 u’汉字’ 构造出来的是unicode类型，不用的话构造出来是str类型

str的编码是与系统环境相关的，一般就是sys.getfilesystemencoding()得到的值

所以从unicode转str，要用encode方法

从str转unicode，所以要用decode

例如：

# coding=utf-8   #默认编码格式为utf-8
s = u&#39;中文&#39; #unicode编码的文字
print s.encode(&#39;utf-8&#39;)   #转换成utf-8格式输出 
print s #效果与上面相同，似乎默认直接转换为指定编码

总结：

u=u'unicode编码文字'

g=u.encode('gbk') #转换为gbk格式

print g #此时为乱码，因为当前环境为utf-8,gbk编码文字为乱码

str=g.decode('gbk').encode('utf-8') #以gbk编码格式读取g（因为他就是gbk编码的）并转换为utf-8格式输出

print str #正常显示中文

安全的方法：

s.decode('gbk','ignore').encode('utf-8′) #以gbk编码读取（当然是读取gbk编码格式的文字了）并忽略错误的编码，转换成utf-8编码输出

因为decode的函数原型是decode([encoding], [errors='strict'])，可以用第二个参数控制错误处理的策略，默认的参数就是strict，代表遇到非法字符时抛出异常；

如果设置为ignore，则会忽略非法字符；

如果设置为replace，则会用?取代非法字符；

如果设置为xmlcharrefreplace，则使用XML的字符引用。

以上是Python文件的读写及文件字符编码设置方法详解的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

Python的主要目的：灵活性和易用性Apr 17, 2025 am 12:14 AM

Python的灵活性体现在多范式支持和动态类型系统，易用性则源于语法简洁和丰富的标准库。1.灵活性：支持面向对象、函数式和过程式编程，动态类型系统提高开发效率。2.易用性：语法接近自然语言，标准库涵盖广泛功能，简化开发过程。

Python：多功能编程的力量Apr 17, 2025 am 12:09 AM

Python因其简洁与强大而备受青睐，适用于从初学者到高级开发者的各种需求。其多功能性体现在：1)易学易用，语法简单；2)丰富的库和框架，如NumPy、Pandas等；3)跨平台支持，可在多种操作系统上运行；4)适合脚本和自动化任务，提升工作效率。

每天2小时学习Python：实用指南Apr 17, 2025 am 12:05 AM

可以，在每天花费两个小时的时间内学会Python。1.制定合理的学习计划，2.选择合适的学习资源，3.通过实践巩固所学知识，这些步骤能帮助你在短时间内掌握Python。

Python与C：开发人员的利弊Apr 17, 2025 am 12:04 AM

Python适合快速开发和数据处理，而C 适合高性能和底层控制。1)Python易用，语法简洁，适用于数据科学和Web开发。2)C 性能高，控制精确，常用于游戏和系统编程。

Python：时间投入和学习步伐Apr 17, 2025 am 12:03 AM

学习Python所需时间因人而异，主要受之前的编程经验、学习动机、学习资源和方法及学习节奏的影响。设定现实的学习目标并通过实践项目学习效果最佳。

Python：自动化，脚本和任务管理Apr 16, 2025 am 12:14 AM

Python在自动化、脚本编写和任务管理中表现出色。1)自动化：通过标准库如os、shutil实现文件备份。2)脚本编写：使用psutil库监控系统资源。3)任务管理：利用schedule库调度任务。Python的易用性和丰富库支持使其在这些领域中成为首选工具。

Python和时间：充分利用您的学习时间Apr 14, 2025 am 12:02 AM

要在有限的时间内最大化学习Python的效率，可以使用Python的datetime、time和schedule模块。1.datetime模块用于记录和规划学习时间。2.time模块帮助设置学习和休息时间。3.schedule模块自动化安排每周学习任务。

Python：游戏，Guis等Apr 13, 2025 am 12:14 AM

Python在游戏和GUI开发中表现出色。1)游戏开发使用Pygame，提供绘图、音频等功能，适合创建2D游戏。2)GUI开发可选择Tkinter或PyQt，Tkinter简单易用，PyQt功能丰富，适合专业开发。

See all articles

热AI工具

Undresser.AI Undress

人工智能驱动的应用程序，用于创建逼真的裸体照片

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

免费脱衣服图片

Clothoff.io

AI脱衣机

AI Hentai Generator

免费生成ai无尽的。

显示更多

热工具

Python文件的读写及文件字符编码设置方法详解

一. python打开文件

二、python读取文件内容f.read([size])

三、python写入文件f.write(string)

四、文件中的内容定位

五、关闭文件

六. f.writelines不会输出换行符

七. python代码文件的编码

python字符串的编码

总结：

热AI工具

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

AI Hentai Generator

热门文章

热工具

MinGW - 适用于 Windows 的极简 GNU

EditPlus 中文破解版

SublimeText3汉化版

SublimeText3 Linux新版

禅工作室 13.0.1

热门话题