导入相关的两个库

import requests from lxml import etree

将网址赋值给变量url

url = 'http://renwen.sanyau.edu.cn/?article/14263.html'

结合网站链接生成get请求赋值给变量res

res = requests.get(url)

查看服务器的状态码

print('状态码', res.status_code)

查看服务器返回的编码

print('编码', res.encoding)

使用xpath解析网页,输出新闻标题

html = etree.HTML(res.text) newtitle = html.xpath('//*[@id='article-title']/text()')[0] print(newtitle)

Python爬虫实战:使用requests和xpath解析网页获取新闻标题

原文地址: https://www.cveoy.top/t/topic/owoZ 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录