码迷,mamicode.com
首页 > 其他好文 > 详细

从国家统计局官网获取最新省市区三级联动数据

时间:2017-03-09 13:16:19      阅读:1608      评论:0      收藏:0      [点我收藏+]

标签:src   dom   .com   image   alt   分享   lag   www   效果图   

目前从国家统计局官网找到的最新的县及县以上行政区划代码:http://www.stats.gov.cn/tjsj/tjbz/xzqhdm/201608/t20160809_1386477.html

技术分享

 

可以看出省市区是有明显的缩进的,所以我们提取数据的时候可以从这个缩进做文章,下面开始分析页面:

 

技术分享

 

查看页面dom结构,可以发现 北京市 市辖区 东城区 ,分别对应 省市区三个级别,他们前面的空格(其实不是空格,是一个特殊的空白符,为了方便就叫空格吧)数量是不一样的,我们就可以从空格数量判断出该数据的级别,然后存入数据库

解析html,我采用了 htmlagilitypack 组件,下面上代码吧:

技术分享

效果图:

技术分享

 

demo下载:http://files.cnblogs.com/files/stulzq/%E5%9F%8E%E5%B8%82%E4%B8%89%E7%BA%A7%E8%81%94%E5%8A%A8%E6%95%B0%E6%8D%AE.zip

 

从国家统计局官网获取最新省市区三级联动数据

标签:src   dom   .com   image   alt   分享   lag   www   效果图   

原文地址:http://www.cnblogs.com/stulzq/p/6524805.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!