Python文本乱码发生时的解决方案

开发 后端
Python文本乱码需要修改相关的代码,但是如何才能更好的解决?看完下面的文章我们就会有所收获,希望在今后的使用中有所用处。

Python文本乱码这个问题在我们使用的时候会发生在很多地方,其实我们需要不断的进行相关代码的调整,在下面的文章中你会找到相关的解决方法。希望大家详仔细的学习。

在处理utf8文本格式的时候,由于这些文本是含BOM(byte order mark)的utf8文本,编译时产生一个Error,”UnicodeEncodeError: ‘gbk’ codec can’t encode character u’\ufeff’ in position 0: illegal multibyte sequence”

原来,某些软件,如notepad,在保存一个以UTF-8编码的文件时,会在文件开始的地方插入三个不可见的字符(0xEF 0xBB 0xBF,即BOM)。 因此我们在读取时需要自己去掉这些字符,Python中的codecs module定义了这个常量:

查看源代码打印帮助

  1. import codecs   
  2. data = open("Test.txt").read()   
  3. if data[:3] == codecs.BOM_UTF8:   
  4. datadata = data[3:]   
  5. print data.decode("utf-8")   


以上就是对Python文本乱码发生时代码修改的详细介绍。

【编辑推荐】

  1. 关于Python脚本语言进行学习介绍
  2. 深度剖析Python脚本语言功能
  3. C++调用python脚本函数基本应用指南
  4. 有关Python脚本相关说明介绍
  5. 讲述C++中调用Python脚本
责任编辑:张浩 来源: IT168
相关推荐

2010-05-17 14:17:25

MySQL pytho

2011-12-21 14:46:26

JavaJFreeChart

2023-09-07 10:37:43

OCR项目字符串

2010-05-17 14:49:43

MySQL中文乱码

2011-02-23 17:13:19

FileZilla

2021-01-11 10:10:23

开发文本溢出开发技术

2010-05-12 16:47:54

MySQL 中文乱码

2010-05-04 09:34:18

Oracle em

2010-05-31 18:33:00

MySQL中文乱码

2013-04-25 14:26:54

GridView

2009-07-24 11:24:33

ASP.NET中文乱码

2010-06-07 09:22:21

2019-03-07 09:00:00

文本挖掘机器学习人工智能

2023-03-16 13:56:19

周界安全工业安全

2009-08-07 10:36:18

linux命令乱码linux命令行乱码Linux操作系统

2017-06-01 11:17:57

Python异常重试解决方案

2015-10-08 08:51:40

PHP内存耗尽解决方案

2018-12-03 11:59:42

Inventec解决方案

2018-12-03 12:26:30

YADRO解决方案

2018-12-03 12:13:21

Mellanox解决方案
点赞
收藏

51CTO技术栈公众号