Python爬虫实战:使用requests和xpath解析网页获取新闻标题
导入相关的两个库
import requests from lxml import etree
将网址赋值给变量url
url = 'http://renwen.sanyau.edu.cn/?article/14263.html'
结合网站链接生成get请求赋值给变量res
res = requests.get(url)
查看服务器的状态码
print('状态码', res.status_code)
查看服务器返回的编码
print('编码', res.encoding)
使用xpath解析网页,输出新闻标题
html = etree.HTML(res.text) newtitle = html.xpath('//*[@id='article-title']/text()')[0] print(newtitle)
原文地址: https://www.cveoy.top/t/topic/owoZ 著作权归作者所有。请勿转载和采集!