码迷,mamicode.com
首页 > Web开发 > 详细

htmlcleaner使用及xpath语法

时间:2016-02-02 16:42:15      阅读:573      评论:0      收藏:0      [点我收藏+]

标签:

一、HtmlCleaner

1、创建htmlCleaner对象

HtmlCleaner htmlCleaner = new HtmlCleaner();

2、调用clean方法

TagNode tagNode = htmlCleaner.clean(html内容或url);

3、使用XPath

Object[] aArr = tagNode.evaluateXPath("//div[@class=‘breadcrumb‘]//a");

二、XPath

例:div,属性class为breadcrumb下面的所有a标签

//div[@class=‘breadcrumb‘]//a

常用路径表达式:

表达式描述
nodename 选取此节点的所有子节点。
/ 从根节点选取。
// 从匹配选择的当前节点选择文档中的节点,而不考虑它们的位置。
. 选取当前节点。
.. 选取当前节点的父节点。
@ 选取属性。

参考资料

http://blog.csdn.net/reesun/article/details/8021201

htmlcleaner使用及xpath语法

标签:

原文地址:http://www.cnblogs.com/sysout/p/5177738.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!