针对httpskgockcestcnkgolistdbId=1005&word=E4BABAE6898D&shortName=ALL&page=1&order=3该网站爬出数据要求输出每一条政策的标题
以下是针对该网站爬取数据并输出政策标题的Python代码:
import requests
from bs4 import BeautifulSoup
url = "https://kgo.ckcest.cn/kgo/list?dbId=1005&word=%E4%BA%BA%E6%89%8D&shortName=ALL&page=1&order=3"
r = requests.get(url)
soup = BeautifulSoup(r.content, 'html.parser')
policy_titles = []
for item in soup.select('.result-item'):
title = item.select_one('.result-title').text.strip()
policy_titles.append(title)
print(policy_titles)
这段代码首先使用requests库向目标网站发送请求,然后使用BeautifulSoup库解析网页内容。使用CSS选择器选出每一条政策的容器元素,再从中提取出标题文本,并将其添加到一个列表中。最后输出这个列表即可
原文地址: https://www.cveoy.top/t/topic/dxqa 著作权归作者所有。请勿转载和采集!