此时情绪此时天,无事小神仙
好好生活,平平淡淡每一天

编辑

python-爬虫中的extract()

<ul class="list">
  <li>123</li>
  <li>abc</li>
</ul>
 
#1
xx.xpath("./ul[@class='list']/li")   #xx是html文档
#xpath解析返回一个解析器列表
 
#2
xx.xpath("./ul[@class='list']/li").extract()
#output
#['123','abc]
#extract使提取内容转换为Unicode字符串,返回数据类型为list
 
#3
xx.xpath("./ul[@class='list']/li").extract()[0]
#output
#['123']
#返回列表中第一个元素
 
#4
xx.xpath("./ul[@class='list']/li")[0].extract()
#output与3相同
#返回SelectorList里的第一个元素
 
#5
#xx.xpath("./ul[@class='list']/li".extract_first()
#output与3相同
#和3作用效果相同
 
#6
xx.xpath("./ul[@class='list']/li")[0].extract()[0]
#output
#'1'
#返回SelectorList里的第一个元素的第一个字符

参考链接:

https://blog.csdn.net/nzjdsds/article/details/77278400

https://blog.csdn.net/w2blue/article/details/80070131

https://www.zhihu.com/question/63370553/answer/247633004

posted @ 2020-08-19 13:44  踏步  阅读(4598)  评论(0编辑  收藏  举报