go用xpath提取html文件的内容常用示例
以下是一些常用的示例,展示了如何使用XPath提取HTML文件的内容:
- 提取所有标题的文本内容:
//h1/text()
- 提取所有链接的URL:
//a/@href
- 提取所有段落的文本内容:
//p/text()
- 提取具有特定class属性的所有元素的文本内容:
//*[@class='example-class']/text()
- 提取具有特定id属性的元素的文本内容:
//*[@id='example-id']/text()
- 提取具有特定标签名称的第一个元素的文本内容:
//tag-name[1]/text()
- 提取具有特定属性值的元素的文本内容:
//*[@attribute='value']/text()
- 提取具有特定属性值的元素及其子元素的文本内容:
//*[@attribute='value']//text()
这些示例只是XPath的一小部分,XPath还有许多其他功能和语法。您可以根据具体的HTML结构和需要进行调整和扩展
原文地址: https://www.cveoy.top/t/topic/inlH 著作权归作者所有。请勿转载和采集!