码迷,mamicode.com
首页 > 编程语言 > 详细

python 获取html置顶标签文本信息

时间:2014-09-28 15:52:22      阅读:288      评论:0      收藏:0      [点我收藏+]

标签:blog   os   ar   div   art   on   c   log   html   

class MyParser(HTMLParser):
    def __init__(self,key):
        self.data=[]
        self.key=key
        self.falg=False
        self.linkname=‘‘
        HTMLParser.__init__(self)
    def handle_starttag(self,tag,attrs):
        if self.key and tag ==self.key:
            self.falg=True
    def handle_data(self,data):
        if self.falg and data:
            self.data.append(unicode(eval(repr(data)),"utf-8"))
    def handle_endtag(self,tag):
        if self.key and tag ==self.key:
            self.falg=False
    def getresult(self):
        return self.data
    
def get_html_tagdata(data,tag):
    IParser = MyParser(tag)
    IParser.feed(data)
    result=IParser.getresult()
    IParser.close()
    return result

  

python 获取html置顶标签文本信息

标签:blog   os   ar   div   art   on   c   log   html   

原文地址:http://www.cnblogs.com/huangjianan/p/3998139.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!