Python 图片爬取:完整代码示例和最佳实践
以下是一个使用 Python 爬取网站上图片的示例代码:\n\npython\nimport requests\nfrom bs4 import BeautifulSoup\nimport os\n\n# 创建保存图片的文件夹\ndef create_folder(folder_name):\n if not os.path.exists(folder_name):\n os.makedirs(folder_name)\n\n# 下载图片\ndef download_image(url, folder_name):\n response = requests.get(url)\n if response.status_code == 200:\n file_name = url.split('/')[-1]\n file_path = os.path.join(folder_name, file_name)\n with open(file_path, 'wb') as f:\n f.write(response.content)\n print(f"成功下载图片:{file_name}")\n else:\n print(f"下载图片失败:{url}")\n\n# 解析网页,获取图片链接\ndef get_image_links(url):\n response = requests.get(url)\n soup = BeautifulSoup(response.text, 'html.parser')\n image_links = []\n for img in soup.find_all('img'):\n src = img.get('src')\n if src and src.startswith('http'):\n image_links.append(src)\n return image_links\n\n# 主函数\ndef main(url, folder_name):\n create_folder(folder_name)\n image_links = get_image_links(url)\n for link in image_links:\n download_image(link, folder_name)\n\n# 示例调用\nif __name__ == '__main__':\n url = 'https://example.com' # 需要爬取图片的网站url\n folder_name = 'images' # 保存图片的文件夹名\n main(url, folder_name)\n\n\n请注意,这只是一个基本示例,具体的爬取方法可能因网站结构而异。在实际使用中,你可能需要根据具体的网站结构和需求进行适当的修改和调整。另外,爬取网站上的图片需要遵循网站的使用规则和法律法规,确保合法合规。
原文地址: https://www.cveoy.top/t/topic/pQjf 著作权归作者所有。请勿转载和采集!