码迷,mamicode.com
首页 > Web开发 > 详细

PHP - 如何解析HTML文件

时间:2016-05-26 22:12:18      阅读:183      评论:0      收藏:0      [点我收藏+]

标签:justify   style   如何   

有一个开源的PHP库“PHP Simple HTML DOM Parser”,其官方网址为http://simplehtmldom.sourceforge.net/,它可以将HTML文件解析为DOM模型,并且其查找DOM对象的语法类似jQuery,使用很方便,具体用法到官网看帮助。

对于中文网页,如果编码不是UTF-8的,则需要采用如下代码转换:

$info = file_get_contents("http://www.siluke.com/0/78/78773/");

$info = iconv("gbk", "utf-8//IGNORE", $info);

$dom = str_get_html($info);

就是先用file_get_contents()得到页面内容,再用iconv()转换编码,最后用str_get_html()生成DOM树。

PHP - 如何解析HTML文件

标签:justify   style   如何   

原文地址:http://lancelot.blog.51cto.com/393579/1783619

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!