python怎么爬去<span>lt;/span>中间标签的内容

如题所述

这个要看你使用的是什么页面解析工具了

html = """
<span class='red'>item1</span>
<div>
    <span id='s1'>item2</span>
</div>
"""
# 使用 scrapy 的Selector
from scrapy.selector import Selector
 
# scrapy 的选择器支持 css和xpath选择。下面是css选择器。如果你了解前端JQuery的知识,
# 会发现
Selector(text=html).css('span::text').extract()
# 输出 : ['item1','item2']
Selector(text=html).css('span#s1::text').extract()
# 输出 : ['item2']
Selector(text=html).css('div>span::text').extract()
# 输出 : ['item2']
 
 
# 使用bs4
from bs4 import BeautifulSoup
 
 
soup = BeautifulSoup(html,'html.parser')
sl = soup.find_all("span")
result = [span.get_text() for span in sl]
print(result)
# ['item1', 'item2']

温馨提示:答案为网友推荐,仅供参考
相似回答