码迷,mamicode.com
首页 > 编程语言 > 详细

Python3中如何解决中文乱码与编码的问题

时间:2018-08-04 23:24:51      阅读:237      评论:0      收藏:0      [点我收藏+]

标签:python   utf8   方法   转换   als   控制台   乱码   控制   判断   

1.解决乱码问题:   

    pyhton中内部所有编码是Unicode,中文是gbk;正常情况下,我们输出的是utf-8;  

    我们可以采用sys.getdefaultencoding()查看系统默认的编码; 解决方法有如下几种:

        1.在文件开头添加上:#coding:utf-8或者# -*- coding:utf-8 -*-

         2.转换路径:原文件编码 ->unicode中转码 ->我们需要的编码格式     (decode()可选) ->unicode ->encode(),如果内容已经unicode,则不需要decode(),直接使用encode()

         3.举例:  

                 a.如果网页是utf-8,我们可使用html.read().decode(‘utf-8‘)将网页在控制台打印;  

                 b.如果网页是gb2312,则使用html.read().decode(‘gbk‘).encode(‘‘utf-8)正常打印;(注意:decode(‘gbk‘)不能使用gbk2312,需用统一使用gbk)  

         4.判断指定的内容是什么编码:(注意:使用unicode只针对python2,python3已经取消了unicode函数,python3默认是utf8编码,Python 3中基本的str就是unicode,所以可以直接判断str: >>> isinstance(‘s‘, str) True)      

               if isinstance(content,unicode):表示如果content编码为unicode则为True,否则False

Python3中如何解决中文乱码与编码的问题

标签:python   utf8   方法   转换   als   控制台   乱码   控制   判断   

原文地址:https://www.cnblogs.com/ysq0908/p/9420436.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!