标签:编码方式 没有 解析 import python 工具箱 自动 style string
beautiful soup 是Python的一个HTML或XML的解析库。
他提供一个简单的、Python式的函数来处理导航、搜索、修改分析数等功能。它是一个工具箱,通过解析文档为用户提供需要抓取的数据,因为简单,所以不需要多少代码就可以写出一个完整的应用程序。
beautiful soup 自动将输入文档转化为Unicode编码,输出文档转化为utf-8编码。你不需要考虑编码方式,除非文档没有指定一个编码方式,这时你仅仅需要说明一下原始的编码方式就可以了。
from bs4 import Beautiful soup=Beautifulsoup(‘<p>hello</p>‘,‘lxml‘)
print(soup.p.string)
标签:编码方式 没有 解析 import python 工具箱 自动 style string
原文地址:https://www.cnblogs.com/kangxi/p/9581319.html