阿里云9.9元云服务器限时购买

python 根据中文表头标题抓取动态(表格)文档数据

思路

如图左侧表头标题,要获得右侧数据。网页数据提取成汉字,表格数据间会有空格,用split()分隔成list。用index()查找某个汉字表头位置,输出list下一个位置既是要得到值

1
2
3
4
5
6
7
text2 ='网页纯文本,爬虫数据自己转换'
# 字符串分割成列表,Python 分割字符串使用 变量.split("分割标示符号"[分割次数]),分割次数表示分割最大次数,为空则分割所有。
list2 = text2.split()
#列表根据内容查找某个值的位置,list2为列表的名字,p是查找的值在list的位置
p = list2.index('查找的值,如管理规模区间')
# v就是要获取的值,如20-50亿元
v = list2[p + 1

  

posted @   HIIT  阅读(271)  评论(0编辑  收藏  举报
编辑推荐:
· AI与.NET技术实操系列:向量存储与相似性搜索在 .NET 中的实现
· 基于Microsoft.Extensions.AI核心库实现RAG应用
· Linux系列:如何用heaptrack跟踪.NET程序的非托管内存泄露
· 开发者必知的日志记录最佳实践
· SQL Server 2025 AI相关能力初探
阅读排行:
· winform 绘制太阳,地球,月球 运作规律
· 震惊!C++程序真的从main开始吗?99%的程序员都答错了
· 【硬核科普】Trae如何「偷看」你的代码?零基础破解AI编程运行原理
· 超详细:普通电脑也行Windows部署deepseek R1训练数据并当服务器共享给他人
· 上周热点回顾(3.3-3.9)
历史上的今天:
2016-10-25 微信公众号支付JSAPI网页,total_fee错误不正确,header重定向参数丢失,无法获取订单号和金额解决
阿里云限时红包 最高 ¥ 2000 云产品通用红包,可叠加官网常规优惠使用
点击右上角即可分享
微信分享提示