码迷,mamicode.com
首页 > 编程语言 > 详细

python读取中文字符编码问题

时间:2015-06-02 11:21:50      阅读:141      评论:0      收藏:0      [点我收藏+]

标签:python   编码   utf-8   

preface:许久没遇到过编码问题,一没注意就被绊倒脚了。。

一、编辑器是以ASICC编码格式的,若想在程序中有中文,需要改为utf-8格式,加入如下代码可破:

<span style="font-size:18px;">import sys  
reload(sys)  
sys.setdefaultencoding('utf8')  </span>
或者参考卤主转载的这篇http://blog.csdn.net/u010454729/article/details/40476015,另外一种方式可破。

二、读取中文文档时,卤主天真的以为字符长度是根据中文长度来着,但是读入后发现是根据字符长度来着,一个中文字长度字符长度为3。发现codecs可破:

<span style="font-size:18px;">import codecs
with codecs.open("XXX.txt", encoding = "utf-8") as f:
    text  =  f.readlines()
for i in text:
    i = i.strip("\n")
    print i,len(i)</span>


python读取中文字符编码问题

标签:python   编码   utf-8   

原文地址:http://blog.csdn.net/u010454729/article/details/46324161

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!