从国家统计局官网获取最新省市区三级联动数据

目前从国家统计局官网找到的最新的县及县以上行政区划代码:http://www.stats.gov.cn/tjsj/tjbz/xzqhdm/201608/t20160809_1386477.html

 

可以看出省市区是有明显的缩进的,所以我们提取数据的时候可以从这个缩进做文章,下面开始分析页面:

 

 

查看页面dom结构,可以发现 北京市 市辖区 东城区 ,分别对应 省市区三个级别,他们前面的空格(其实不是空格,是一个特殊的空白符,为了方便就叫空格吧)数量是不一样的,我们就可以从空格数量判断出该数据的级别,然后存入数据库

解析html,我采用了 htmlagilitypack 组件,下面上代码吧:

效果图:

 

demo下载:https://files.cnblogs.com/files/stulzq/%E5%9F%8E%E5%B8%82%E4%B8%89%E7%BA%A7%E8%81%94%E5%8A%A8%E6%95%B0%E6%8D%AE.zip

 

作者:晓晨Master(李志强)

出处:https://www.cnblogs.com/stulzq/p/6524805.html

版权:本作品采用「署名-非商业性使用-相同方式共享 4.0 国际」许可协议进行许可。

posted @   晓晨Master  阅读(5797)  评论(2编辑  收藏  举报
编辑推荐:
· Linux系列:如何用 C#调用 C方法造成内存泄露
· AI与.NET技术实操系列(二):开始使用ML.NET
· 记一次.NET内存居高不下排查解决与启示
· 探究高空视频全景AR技术的实现原理
· 理解Rust引用及其生命周期标识(上)
阅读排行:
· DeepSeek 开源周回顾「GitHub 热点速览」
· 物流快递公司核心技术能力-地址解析分单基础技术分享
· .NET 10首个预览版发布:重大改进与新特性概览!
· AI与.NET技术实操系列(二):开始使用ML.NET
· 单线程的Redis速度为什么快?
more_horiz
keyboard_arrow_up light_mode palette
选择主题
点击右上角即可分享
微信分享提示