要使用 XPath 爬取 td 标签中所有 p 标签的内容,可以使用以下代码:

import requests
from lxml import etree

# 发送请求获取页面内容
url = 'http://example.com'
response = requests.get(url)
html = response.text

# 使用lxml库解析页面内容
tree = etree.HTML(html)

# 使用XPath选择td标签中所有p标签的内容
p_content_list = tree.xpath('//td/p/text()')

# 打印p标签的内容
for content in p_content_list:
    print(content)

请注意,上述代码中的url变量需要替换为您要爬取的网页的URL地址。另外,如果您需要获取 p 标签的其他属性值,可以修改 XPath 表达式来选择相应的属性。例如,要获取 p 标签的 class 属性值,可以使用//td/p/@class作为 XPath 表达式。


原文地址: https://www.cveoy.top/t/topic/pUHm 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录