以下是使用 Python Pandas 抓取 'http://www.sina.com.cn' 网页中的数据,并显示数据内容,加入请求头,加入 utf8 编码的示例代码:

import pandas as pd
import requests

url = 'http://www.sina.com.cn'
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/58.0.3029.110 Safari/537.36',
    'Accept-Language': 'en-US,en;q=0.8'
}

response = requests.get(url, headers=headers)
response.encoding = 'utf-8'

data = pd.read_html(response.text)
print(data)

在这个示例中,我们首先定义了要抓取的网页 URL 和请求头 headers。这里我们使用了一个简单的 User-Agent 和 Accept-Language 请求头。接下来,我们使用 requests 库发送 HTTP GET 请求并传递请求头。然后,我们将响应的编码设置为 utf-8,并使用 Pandas 的 read_html 函数来解析 HTML,并将结果存储在 data 变量中。最后,我们打印出 data 以查看抓取到的数据。

请注意,Pandas 的 read_html 函数只能解析 HTML 数据,因此在实际使用中可能需要根据需要使用其他解析库。此外,我们还可以使用 BeautifulSoup 等类似的库来处理 HTML 数据并提取所需的信息。

Python Pandas 抓取新浪网数据:完整示例代码及解析

原文地址: http://www.cveoy.top/t/topic/mGpL 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录